arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

New York University(纽约大学)

2025-11-24 至 2025-11-24 共收录 3
2511.15738 2025-11-24 cs.LG cs.AI

Extending Test-Time Scaling: A 3D Perspective with Context, Batch, and Turn

扩展测试时间缩放:一种具有上下文、批量和回合的三维视角

Chao Yu, Qixin Tan, Jiaxuan Gao, Shi Yu, Hong Lu, Xinting Yang, Zelai Xu, Yu Wang, Yi Wu, Eugene Vinitsky

机构 * Tsinghua University(清华大学) New York University(纽约大学)

AI总结 本文提出三维测试时间缩放框架,通过上下文、批量和回合三个维度提升推理性能,并在多个测试环境中验证其有效性。

Comments 44 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17260 2025-11-24 cs.CL

The Rise of Parameter Specialization for Knowledge Storage in Large Language Models

大语言模型中用于知识存储的参数专业化趋势的兴起

Yihuai Hong, Yiran Zhao, Wei Tang, Yang Deng, Yu Rong, Wenxuan Zhang

机构 * Alibaba Group(阿里巴巴集团) New York University(纽约大学) National University of Singapore(新加坡国立大学) Singapore Management University(新加坡管理大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 本研究分析了大语言模型中MLP参数的知识存储方式,发现参数专业化提高了知识利用效率,并通过实验验证了其重要性。

Comments Accepted in NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12972 2025-11-24 cs.CV cs.AI

Aligning Vision to Language: Annotation-Free Multimodal Knowledge Graph Construction for Enhanced LLMs Reasoning

对齐视觉与语言:无需注释的多模态知识图谱构建以增强大语言模型推理

Junming Liu, Siyuan Meng, Yanting Gao, Song Mao, Pinlong Cai, Guohang Yan, Yirong Chen, Zilin Bian, Ding Wang, Botian Shi

机构 * Tongji University(同济大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) East China Normal University(华东师范大学) Stanford University(斯坦福大学) New York University(纽约大学)

AI总结 本文提出 VaLiK 方法,通过跨模态信息补充构建无需注释的多模态知识图谱,提升大语言模型推理能力。

Comments 14 pages, 7 figures, 6 tables; Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏