机构
*
California State University, Dominguez Hills(加州州立大学多明戈斯山分校)
;
University of California, Irvine(加州大学欧文分校)
;
Johns Hopkins University(约翰斯·霍普金斯大学)
;
Arizona State University(亚利桑那州立大学)
专题命中
指令微调
:instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.AI
CommentsPublished as Oral Paper at Learning at Scale, 2026. Link: https://dl.acm.org/doi/10.1145/3774398.3811609. 21 pages, 8 figures, 8 tables. Joshua Mitton and Prarthana Bhattacharyya contributed equally to this paper
机构
*
National Yang Ming Chiao Tung University(国立阳明交通大学)
;
Institute of Computer Science and Engineering(工程与计算机科学学院)
;
College of Artificial Intelligence(人工智能学院)
专题命中
指令微调
:language model(title,abstract)
AI总结
针对VLMs理解空间语义时 allocentric 与 egocentric 参考框架的歧义问题,构建数据集AlloEgo-View并开发框架AlloEgo-VLM,经NVIDIA Isaac Sim平台验证其在具身机器人开放式物体搜索任务中的有效性。
Step-Level On-Policy Distillation: Interpolating Between On-Policy Distillation and Supervised Fine-Tuning
步骤级在线策略蒸馏:在线策略蒸馏与监督微调的插值方法
Changhui Sun, Lanbo Liu, Hang Lei, Tong Ling, Jiahang Xie, Zhiyong Zheng, Yujia Wang, Hao Liu, Feng Xiao, Lu Liu, Yanlong Du, Zifeng Cheng, Ziwei Jiang, Qing Gu
机构
*
State Key Laboratory for Novel Software Technology, Nanjing University(南京大学现代软件技术国家重点实验室)
;
XingYun Lab, HUJING Digital Media & Entertainment Group(星云实验室,沪景数字媒体娱乐集团)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Data Science, Fudan University(复旦大学数据科学学院)