Data-Efficient Autoregressive-to-Diffusion Language Models via On-Policy Distillation
数据高效的自回归到扩散语言模型通过策略内蒸馏
Xingyu Su, Jacob Helwig, Shubham Parashar, Atharv Chagi, Lakshmi Jotsna, Degui Zhi, James Caverlee, Dileep Kalathil, Shuiwang Ji
机构
*
Department of Computer Science and Engineering, Texas A&M University(德克萨斯大学阿马尔科分校计算机科学与工程系)
;
Department of Bioinformatics and Systems Medicine, University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校生物信息学与系统医学系)
;
Department of Electrical and Computer Engineering, Texas A&M University(德克萨斯大学阿马尔科分校电气与计算机工程系)
Human Adults and LLMs as Scientists: Who Benefits from Active Exploration?
人类成人与LLM作为科学家:谁从主动探索中受益?
Mandana Samiei, Eunice Yiu, Anthony GX-Chen, Dongyan Lin, Jocelyn Shen, Blake A. Richards, Alison Gopnik, Doina Precup
机构
*
Mila - Quebec AI Institute(魁北克人工智能研究所)
;
McGill University(麦吉尔大学)
;
University of California Berkeley(加州大学伯克利分校)
;
New York University(纽约大学)
;
Meta FAIR
;
MIT Media Lab(麻省理工学院媒体实验室)
;
Montreal Neurological Institute(蒙特利尔神经科学研究所)
专题命中
效率与部署
:LLM(title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Watch, Remember, Reason: Human-View Video Understanding with MLLMs
Watch, Remember, Reason: 基于多模态大语言模型的人类视角视频理解
Jiahao Meng, Yue Tan, Qi Xu, Kuan Gao, Weisong Liu, Yanwei Li, Jason Li, Lingdong Kong, Haochen Wang, Qianyu Zhou, Jiangning Zhang, Guangliang Cheng, Yunhai Tong, Lu Qi, Minghsuan Yang
机构
*
School of Intelligence Science and Technology, Peking University(北京理工大学智能科学与技术学院)
;
Wuhan University(武汉大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
Nanyang Technological University(南洋理工大学)
;
CASIA(中国科学院自动化研究所)
;
University of Tokyo(东京大学)
;
University of Liverpool(利物浦大学)
;
Zhejiang University(浙江大学)
;
National University of Singapore(新加坡国立大学)
;
UC Merced(加州大学默塞德分校)
专题命中
效率与部署
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI
Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio
全保真音频无损压缩的语言建模基准测试
Phillip Long, Zachary Novack, Chris Donahue
机构
*
University of California, San Diego, Computer Science and Engineering Department(加州大学圣地亚哥分校计算机科学与工程系)
;
Carnegie Mellon University, School of Computer Science(卡内基梅隆大学计算机科学学院)
MACS: Modality-Aware Capacity Scaling for Efficient Multimodal MoE Inference
MACS: 模态感知容量缩放用于高效多模态MoE推理
Bo Li, Chuan Wu, Shaolin Zhu
机构
*
School of Software, Tsinghua University, Beijing, China(清华大学软件学院,北京,中国)
;
TJUNLP Lab, School of Computer Science and Technology, Tianjin University, China(天津大学计算机科学与技术学院,中国)
;
School of New Media and Communication, Tianjin University, China(天津大学新媒体与传播学院,中国)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
MidSteer: Optimal Affine Framework for Steering Generative Models
MidSteer:用于引导生成模型的最优仿射框架
Tatiana Gaintseva, Andrew Stepanov, Ziquan Liu, Martin Benning, Gregory Slabaugh, Jiankang Deng, Ismail Elezi
机构
*
University of Basel(巴塞尔大学)
;
University of California, Berkeley(加州大学伯克利分校)
;
ETH Zurich(苏黎世联邦理工学院)
;
University of Cambridge(剑桥大学)
;
University of Washington(华盛顿大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
Teaching the Way, Not the Answer: Privileged Tutoring Distillation for Multimodal Policy Optimization
教方法而非答案:用于多模态策略优化的特权辅导蒸馏
Shizhe Xiang, Ke An, Wenlong Yu, Yue Liu, Jian Luan, Pei Fu, Qilong Wang
机构
*
Tianjin University(天津大学)
;
Beijing Institute of Technology(北京理工大学)
;
Singapore Management University(新加坡国立大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Xiaomi Inc(小米公司)
机构
*
School of Cyber Science and Engineering, Wuhan University(武汉大学计算机科学与工程学院)
;
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
Independent Researcher(独立研究者)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.AI