Learning What to Learn: Stage-Specific Data Sets for SFT-then-RL in Small Language Model Reasoning
学习什么:小语言模型推理中SFT-then-RL的阶段特定数据集
Chongyang He, Rui Zhang, Zixuan Wang, Xin Li
机构
*
Tsinghua University(清华大学)
;
National University of Singapore(新加坡国立大学)
;
DiDi(滴滴出行)
;
University of Electronic Science and Technology of China(电子科技大学)
专题命中
指令微调
:SFT(title,title_cn);language model(title,abstract);small language model(title,abstract);SLM(abstract,abstract_cn)
TamperBench: Systematically Stress-Testing LLM Safety Under Fine-Tuning and Tampering
TamperBench:系统化压力测试微调和篡改下的LLM安全性
Saad Hossain, Tom Tseng, Punya Syon Pandey, Samanvay Vajpayee, Matthew Kowal, Nayeema Nonta, Samuel Simko, Stephen Casper, Zhijing Jin, Kellin Pelrine, Sirisha Rambhatla
机构
*
Critical ML Lab Waterloo Canada(Waterloo大学Critical ML实验室)
;
FAR.AI Berkeley USA(伯克利美国FAR.AI公司)
;
University of Toronto Toronto Canada(多伦多大学)
;
University of Waterloo Waterloo Canada(Waterloo大学)
;
ETH Zürich Zürich Switzerland(苏黎世联邦理工学院)
;
MIT CSAIL Cambridge USA(麻省理工学院CSAIL实验室)
;
University of Toronto, MPI, EuroSafeAI, Vector Institute Toronto Canada(多伦多大学、马克斯·普朗克研究所、EuroSafeAI、Vector Institute)
;
Critical ML Lab University of Waterloo Waterloo Canada(Waterloo大学Critical ML实验室)
专题命中
指令微调
:LLM(title,title_cn);large language model(abstract);language model(abstract);post-training(abstract)
机构
*
Mohamed bin Zayed University of AI(Mohamed bin Zayed人工智能大学)
;
Khalifa University(卡利法大学)
;
Michigan State University(密歇根州立大学)
;
Australian National University(澳大利亚国立大学)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);foundation model(comments)
机构
*
School of Artificial Intelligence, Nanjing University, China(南京大学人工智能学院)
;
State Key Laboratory of Novel Software Technology, Nanjing University, China(南京大学新型软件技术国家重点实验室)
专题命中
指令微调
:instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院 Gallagher 学院)
;
Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心,教育部)
;
Baidu Inc.(百度公司)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL
EvoPrompt: Guided Prompt Evolution for Vision-Language Models Adaptation
EvoPrompt: 引导提示演化以适应视觉-语言模型
Enming Zhang, Jiayang Li, Yanlong Wang, Yanru Wu, Zhenyu Liu, Yang Li
机构
*
Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学)
;
Sun Yat-sen University(中山大学)
;
Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))