IRIS: Interpolative Rényi Iterative Self-play for Large Language Model Fine-Tuning
IRIS:基于Rényi的迭代自博弈用于大语言模型微调
Wenjie Liao, Like Wu, Liangjie Zhao, Shihui Xu, Shigeru Fujimura
机构
*
Graduate School of Information, Production and Systems(信息、生产与系统研究生院)
;
Institute of Computing Technology, University of the Chinese Academy of Sciences(中国科学院大学计算技术研究所)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG
Enhancing Multimodal Large Language Models for Ancient Chinese Character Evolution Analysis via Glyph-Driven Fine-Tuning
通过字形驱动微调增强多模态大语言模型用于古汉字演变分析
Rui Song, Lida Shi, Ruihua Qi, Yingji Li, Hao Xu
机构
*
College of Computer Science and Technology, Jilin University, China(吉林大学计算机科学与技术学院)
;
Key Laboratory of Ancient Chinese Script, Culture Relics and Artificial Intelligence, Jilin University, China(吉林大学古文字、文物与人工智能重点实验室)
;
School of Artificial Intelligence, Jilin University, China(吉林大学人工智能学院)
;
School of Archaeology, Jilin University, China(吉林大学考古学院)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
Only relative ranks matter in weight-clustered large language models
仅相对排名在权重聚类的大型语言模型中起作用
Borja Aizpurua, Sukhbinder Singh, Román Orús
机构
*
Department of Basic Sciences, Tecnun - University of Navarra, San Sebasti\'an, Spain
;
Donostia International Physics Center, San Sebasti\'an, Spain
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG
How does fine-tuning improve sensorimotor representations in large language models?
微调如何改善大语言模型中的感知运动表征
Minghua Wu, Javier Conde, Pedro Reviriego, Marc Brysbaert
机构
*
Department of Experimental Psychology, Ghent University(实验心理学系,根特大学)
;
Information Processing and Telecommunications Center (IPTC), Universidad Politécnica de Madrid, Spain(信息处理与电信中心(IPTC),马德里理工大学,西班牙)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
机构
*
Harbin Institute of Technology(哈尔滨工业大学)
;
Kuaishou Technology(快手科技)
;
Meta AI
;
Monash University(墨尔本大学)
;
Fudan University(复旦大学)
;
Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
TAROT: Test-driven and Capability-adaptive Curriculum Reinforcement Fine-tuning for Code Generation with Large Language Models
TAROT: 为基于大语言模型的代码生成设计的测试驱动和能力适应课程强化微调
Chansung Park, Juyong Jiang, Fan Wang, Sayak Paul, Jiasi Shen, Jing Tang, Jianguo Li
机构
*
Electronics and Telecommunications Research Institute(电信研究所)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Hugging Face
;
Ant Group(蚂蚁集团)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
双向偏见归因:无需修改提示的大型语言模型去偏方法
Yujie Lin, Kunquan Li, Yixuan Liao, Xiaoxin Chen, Jinsong Su
机构
*
School of Informatics, Xiamen University, China(厦门大学信息学院)
;
vivo AI Lab, China(vivo AI实验室)
;
Key Laboratory of Digital Protection and Intelligent Processing of Intangible Cultural Heritage of Fujian and Taiwan (Xiamen University), Ministry of Culture and Tourism, China(福建省和台湾非物质文化遗产数字化保护与智能处理重点实验室(厦门大学),文化部,中国)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI
Artificial Entanglement in the Fine-Tuning of Large Language Models
大语言模型微调中的人工纠缠
Min Chen, Zihan Wang, Canyu Chen, Zeguan Wu, Manling Li, Junyu Liu
机构
*
Department of Computer Science, University of Pittsburgh, Pittsburgh, PA 15260, USA(匹兹堡大学计算机科学系)
;
Department of Computer Science, Northwestern University, Evanston, IL 60208, USA(西北大学计算机科学系)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG