arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Cornell University(康奈尔大学)

2026-02-05 至 2026-02-05 共收录 3
2512.22208 2026-02-05 cs.CL cs.CV cs.LG

Open-Source Multimodal Moxin Models with Moxin-VLM and Moxin-VLA

开源多模态Moxin模型:Moxin-VLM和Moxin-VLA

Pu Zhao, Arash Akbari, Xuan Shen, Zhenglun Kong, Yixin Shen, Sung-En Chang, Timothy Rupprecht, Lei Lu, Enfu Nan, Changdi Yang, Yumei He, Weiyan Shi, Xingchen Xu, Yu Huang, Wei Jiang, Wei Wang, Yue Chen, Yong He, Yanzhi Wang

机构 * Northeastern University(东北大学) Harvard University(哈佛大学) Cornell University(康奈尔大学) Tulane University(路易斯安那州立大学) University of Washington(华盛顿大学) Futurewei(未来通信) AIBAO LLC

AI总结 本文提出开源多模态Moxin模型,通过Moxin-VLM、Moxin-VLA和Moxin-Chinese三种变体,提升视觉-语言、视觉-语言-动作及中文任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04118 2026-02-05 cs.LG

Learning to Reason in 13 Parameters

在13个参数中学习推理

John X. Morris, Niloofar Mireshghallah, Mark Ibrahim, Saeed Mahloujifar

机构 * FAIR at Meta(Meta 的 FAIR) Cornell University(康奈尔大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 TinyLoRA通过仅训练13个参数实现高效推理学习,显著提升模型性能并降低训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03876 2026-02-05 cs.LG cs.AI

GOPO: Policy Optimization using Ranked Rewards

GOPO:基于排名奖励的策略优化

Kyuseong Choi, Dwaipayan Saha, Woojeong Kim, Anish Agarwal, Raaz Dwivedi

机构 * Cornell Tech, Cornell University, NY, United States(康奈尔科技、康奈尔大学,纽约,美国) Columbia University, NY, United States(哥伦比亚大学,纽约,美国)

AI总结 GOPO通过使用奖励排名而非绝对值,提高了不可验证任务中策略优化的性能和效率。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏