Silent Sabotage During Fine-Tuning: Few-Shot Rationale Poisoning of Compact Medical LLMs
细调过程中的无声破坏:紧凑型医学LLM的少样本推理污染
Jingyuan Xie, Wenjie Wang, Ji Wu, Jiandong Gao
机构
*
Department of Electronics Engineering, Tsinghua University, Beijing, China(清华大学电子工程系)
;
College of AI, Tsinghua University, Beijing, China(清华大学人工智能学院)
;
Beijing National Research Center for Information Science and Technology, Beijing, China(北京信息科学国家研究中心)
专题命中
指令微调
:large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG
Yixin Nie, Lin Guan, Zhongyao Ma, Anchit Gupta, Yipin Zhou, Xiao Li, Zhengping Zhou, Raymond Zeng, Gelin Zhou, Shigan Chu, Ajay Thampi, Wancen Mu, Nathan Shuster, Ketong Wang, Lin Chen, Jason Brewer, Derek Hao Hu, Alexander McCauley, Jason Weston, Sem Park, Na Zhang, Kevin Tang
机构
*
Meta Superintelligence Labs(Meta超智能实验室)
;
FAIR at Meta(Meta的FAIR部门)
;
OpenAI(开放人工智能研究所)
专题命中
指令微调
:large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI
CommentsThis is the submitted journal version of enhanced with the novel fine-tuning part of "Efficient and Flexible Topic Modeling using Pretrained Embeddings and Bag of Sentences'' which appeared at the International Conference on Agents and Artificial Intelligence(ICAART) in 2024
机构
*
College of Applied Science, Shenzhen University, Shenzhen, China(深圳大学应用科学学院)
;
School of Artificial Intelligence, Shenzhen Technology University, Shenzhen, China(深圳科技大学人工智能学院)
专题命中
指令微调
:large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG
机构
*
LARG, Research Center for Social Computing and Interactive Robotics, HIT(LARG,社会计算与交互机器人研究中心,哈尔滨工业大学)
;
School of Computer Science and Engineering, Central South University(计算机科学与工程学院,中南大学)
;
iFLYTEK
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
DPI: Exploiting Parameter Heterogeneity for Interference-Free Fine-Tuning
DPI: 利用参数异质性实现无干扰的微调
Xiaoyu Liu, Xiaoyu Guan, Di Liang, Xianjie Wu
机构
*
College of Science, Northeastern University, Boston, United States(东北大学科学学院)
;
University of Florida(佛罗里达大学)
;
Beijing Information Science and Technology University(北京信息科技大学)
专题命中
指令微调
:large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI
A self-evolving multi-role collaborative framework with fine-grained difficulty guidance for innovative mathematical problem generation
具有细粒度难度指导的自进化多角色协作框架用于创新数学问题生成
Yifei Sun, Yongan Li, A. K. Qin, Sicheng Hou, Tamas Pflanzner
机构
*
School of Physics and Information Technology, Shaanxi Normal University(陕西师范大学物理与信息技术学院)
;
Department of Computing Technologies, Swinburne University of Technology(斯威本科技大学计算技术系)
;
Department of Software Engineering, University of Szeged(塞格德大学软件工程系)
专题命中
指令微调
:large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI
机构
*
Zhejiang University(浙江大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
University of Waterloo(滑铁卢大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Sun Yat-sen University(中山大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
GEM-Style Constraints for PEFT with Dual Gradient Projection in LoRA
基于LoRA的GEM风格约束与双梯度投影的持续学习
Brian Tekmen, Jason Yin, Qianqian Tong
机构
*
Department of Computer Science University of North Carolina Greensboro(计算机科学系北卡罗来纳州立大学)
;
Department of Computer Science North Carolina State University(计算机科学系北卡罗来纳州立大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG