Attention-Spectrum Regularization for Replay-Free Continual Multimodal LLMs
注意力谱正则化:无回放的连续多模态大语言模型
Chuangxin Zhao, Canran Xiao, Siyuan Ma, Mengyao Lyu, Yanbiao Ma, Jun Xia, Guiguang Ding, Yang Liu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Sun Yat-sen University(中山大学)
;
Nanyang Technological University(南洋理工大学)
;
Renmin University of China(中国人民大学)
;
Tsinghua University(清华大学)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.AI
A Validation-Gated Mechanistic Account of Suicidality Detection in LLMs
一种验证门控机制的自杀检测在LLMs中的解释
Nafiz Ahmed, Sarah Sharif, Dingjing Shi, Mike Banad
机构
*
Intelligent Neuromorphic and Quantum Understanding for Innovative Research and Engineering (INQUIRE) Lab(智能神经形态与量子理解创新研究与工程实验室)
;
School of Electrical and Computer Engineering(电气与计算机工程学院)
;
University of Oklahoma(俄克拉荷马大学)
;
School of Psychology(心理学学院)
;
Georgia Institute of Technology(佐治亚理工学院)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.CL
GTA-Net: Cooperative Game Theory for Vision-Language Alignment in Chest X-Ray Report Generation
GTA-Net:合作博弈论在胸部X光报告生成中的视觉-语言对齐
Saif ur Rehman Khan, Imad Ahmed Waqar, Sebastian Vollmer, Andreas Dengel, Muhammad Nabeel Asim
机构
*
Department of Computer Science, Rhineland-Palatinate Technical University of Kaiserslautern-Landau(莱茵兰-普法尔茨凯泽斯劳滕-兰道工业大学计算机科学系)
;
German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心)
;
IntelligentX GmbH
专题命中
指令微调
:large language model(abstract);language model(abstract)
Enhancing LLMs for Graph Tasks via Graph-aware LoRA Generation
通过图感知的LoRA生成增强LLMs的图任务能力
Junshu Sun, Wanxing Chang, Qingming Huang, Shuhui Wang
机构
*
State Key Lab. of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
DAMO Academy, Alibaba Group(阿里巴巴集团达摩院)
Learning at the Right Pace: Adaptive Data Scheduling Improves LLM Reinforcement Learning
以合适的速度学习:自适应数据调度改进大语言模型强化学习
Zicheng Xu, Ruixuan Zhang, Yu-Neng Chuang, Xiuyi Lou, Hoang Anh Duy Le, Oren Gal, Alexander S. Szalay, Zhaozhuo Xu, Guanchu Wang, Vladimir Braverman
机构
*
Johns Hopkins University(约翰霍普金斯大学)
;
Rice University(莱斯大学)
;
University of Haifa(海法大学)
;
Workato
;
University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)
专题命中
后训练与偏好优化
:LLM(title,summary_cn);large language model(abstract);language model(abstract);post-training(abstract)
机构
*
National Engineering Research Center of Software Engineering, Peking University(北京大学软件工程国家工程研究中心)
;
School of Computer Science, Peking University(北京大学计算机学院)
;
Key Laboratory of High Confidence Software Technologies, Ministry of Education(教育部高可信软件技术重点实验室)
;
Peking University Information Technology Institute, Tianjin Binhai(北京大学滨海信息技术研究院)
;
Research Institute, GRGBanking Equipment Co., Ltd.(广电运通金融电子股份有限公司研究院)
Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning
LLM上的模块化强化学习:从MDP创建到探索与学习
Zhao Yang, Yuxuan Jiang, Ting-Chih Chen, Lincen Yang, Annie Wong, Chao Gao, Jacob E. Kooi, Zhong Li, Jiayang Shi, Kevin Qiu, Qi Huang, Xinrui Zu, Shiping Yang, Hengyuan Zhang, Ngai Wong, Filip Ilievski, Shujian Yu, Aske Plaat, Zhaochun Ren, Mark Hoogendoorn, Vincent François-Lavet
机构
*
VU Amsterdam(阿姆斯特丹自由大学)
;
University of Maryland, Baltimore County(马里兰大学巴尔的摩县分校)
;
Leiden University(莱顿大学)
;
University of Warsaw(华沙大学)
;
Simon Fraser University(西蒙菲莎大学)
;
The University of Hong Kong(香港大学)
机构
*
Center for Advanced Intelligence Project, RIKEN(日本理化学研究所先进智能研究中心)
;
Graduate School of Frontier Sciences, The University of Tokyo(东京大学前沿科学研究生院)
;
Northeastern University(东北大学)
;
Zhejiang Gongshang University(浙江工商大学)
专题命中
后训练与偏好优化
:RLHF(abstract,abstract_cn);LLM(abstract_cn);large language model(abstract);language model(abstract)