LIFT the Veil for the Truth: Principal Weights Emerge after Rank Reduction for Reasoning-Focused Supervised Fine-Tuning
揭开真相的面纱:秩减少后主权重的浮现使以推理为导向的监督微调得以提升
Zihang Liu, Tianyu Pang, Oleg Balabanov, Chaoqun Yang, Tianjin Huang, Lu Yin, Yaoqing Yang, Shiwei Liu
机构
*
University of California, Berkeley, CA, USA(加州大学伯克利分校)
;
International Computer Science Institute, CA, USA(国际计算机科学研究所)
;
Lawrence Berkeley National Laboratory, CA, USA(伯克利国家实验室)
;
Dartmouth College, NH, USA(达特茅斯学院)
;
University of Exeter, Exeter, UK(埃克塞特大学)
;
University of Oxford, Oxford, UK(牛津大学)
;
University of Surrey, Guildford, UK(萨里大学)
;
Tsinghua University, China(清华大学)
;
Eindhoven University of Technology, the Netherlands(埃因霍温理工大学)
Automatic Combination of Sample Selection Strategies for Few-Shot Learning
少样本学习中样本选择策略的自动组合
Branislav Pecher, Ivan Srba, Maria Bielikova, Joaquin Vanschoren
机构
*
Faculty of Information Technology, Brno University of Technology(布拉格技术学院,布拉格技术大学)
;
Kempelen Institute of Intelligent Technologies(智能技术研究所)
;
Eindhoven University of Technology(埃因霍温技术大学)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
IROSA: Interactive Robot Skill Adaptation using Natural Language
IROSA: 基于自然语言的交互机器人技能适应
Markus Knauer, Samuel Bustamante, Thomas Eiband, Alin Albu-Schäffer, Freek Stulp, João Silvério
机构
*
German Aerospace Center (DLR), Institute of Robotics and Mechatronics (RMC)(德国航空航天中心(DLR)机器人与机电研究所)
;
School of Computation, Information and Technology (CIT), Technical University of Munich (TUM)(计算、信息与技术学院(CIT),慕尼黑技术大学)
Efficient Fine-Tuning Methods for Portuguese Question Answering: A Comparative Study of PEFT on BERTimbau and Exploratory Evaluation of Generative LLMs
葡萄牙问答任务中高效的微调方法:对BERTimbau的PEFT系统评估及生成LLMs的探索性评估
Mariela M. Nina, Caio Veloso Costa, Lilian Berton, Didier A. Vega-Oliveros
机构
*
Institute of Science and Technology(科学技术研究院)
;
Federal University of São Paulo (UNIFESP)(圣保罗联邦大学)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG