机构
*
University of Toronto(多伦多大学)
;
Qatar Computing Research Institute(卡塔尔计算研究院)
;
Daffodil International University(达芙妮国际大学)
;
Macquarie University(麦考瑞大学)
From Supervision to Exploration: What Does Protein Language Model Learn During Reinforcement Learning?
Hanqun Cao, Hongrui Zhang, Junde Xu, Zhou Zhang, Lingdong Shen, Minghao Sun, Ge Liu, Jinbo Xu, Wu-Jun Li, Jinren Ni, Cesar de la Fuente-Nunez, Tianfan Fu, Yejin Choi, Pheng-Ann Heng, Fang Wu
机构
*
The Chinese University of Hong Kong(香港中文大学)
;
Peking University(北京大学)
;
Stanford University(斯坦福大学)
;
Nanjing University(南京大学)
;
University of Pennsylvania(宾夕法尼亚大学)
;
National University of Singapore(新加坡国立大学)
;
University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校)
;
Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
Bridging Collaborative Filtering and Large Language Models with Dynamic Alignment, Multimodal Fusion and Evidence-grounded Explanations
Bo Ma, LuYao Liu, Simon Lau, Chandler Yuan, and XueY Cui, Rosie Zhang
机构
*
Department of Software \& Microelectronics, Peking University, Beijing, China
;
Economic Law School, China University of Political Science
;
Financial Media, Peking University, ChangSha, China
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI
Efficient Training of Robust Traditional Chinese LLaMA-1B on a Single Consumer GPU: Continual Pre-training, SFT, and DPO
Yu-Cheng Chih, Ming-Tao Duan, Yong-Hao Hou
专题命中
指令微调
:SFT(title,abstract);language model(abstract,comments);small language model(abstract,comments);preference optimization(abstract)
Comments17 pages, 1 figures, 2 tables. Technical report. Introduces PureTC-1B, an adapter-based pipeline for stabilizing Small Language Models in Traditional Chinese using CPT, SFT, and DPO
机构
*
South China University of Technology(华南理工大学)
;
Institute for Infocomm Research (I 2 R), A*STAR(信息通信研究所(I 2 R),A*STAR)
;
WeChat Vision, Tencent Inc.(微信视觉,腾讯公司)
;
Foshan University(佛山大学)
;
Nanyang Technological University(南洋理工大学)
;
National University of Singapore(新加坡国立大学)
专题命中
指令微调
:LLM(abstract);large language model(abstract);language model(abstract)
Initialization using Update Approximation is a Silver Bullet for Extremely Efficient Low-Rank Fine-Tuning
Kaustubh Ponkshe, Raghav Singhal, Eduard Gorbunov, Alexey Tumanov, Samuel Horvath, Praneeth Vepakomma
机构
*
Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Massachusetts Institute of Technology(麻省理工学院)
专题命中
指令微调
:large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
CommentsKaustubh Ponkshe and Raghav Singhal contributed equally to this work