arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, San Diego(加州大学圣迭戈分校)

2026-02-02 至 2026-02-02 共收录 5
2601.22570 2026-02-02 cs.CV cs.LG

Leveraging Data to Say No: Memory Augmented Plug-and-Play Selective Prediction

利用数据说不:基于记忆的插拔式选择预测

Aditya Sarkar, Yi Li, Jiacheng Cheng, Shlok Mishra, Nuno Vasconcelos

机构 * University of Maryland, College Park(马里兰大学) University of California, San Diego(加州大学圣地亚哥分校) Qualcomm AI(高通人工智能) Yale University(耶鲁大学) Meta AI

AI总结 本文提出基于记忆的插拔式选择预测方法,通过增强视觉语言嵌入来减少方差并改进分数校准,提升图像描述、匹配和细粒度分类性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22249 2026-02-02 cs.LG cs.SE

FunPRM: Function-as-Step Process Reward Model with Meta Reward Correction for Code Generation

FunPRM:基于元奖励校正的函数作为步骤过程奖励模型用于代码生成

Ruiyi Zhang, Peijia Qin, Qi Cao, Eric Xue, Pengtao Xie

机构 * University of California, San Diego(加州大学圣迭戈分校)

AI总结 FunPRM通过元学习的奖励校正机制提升代码生成性能,实现更高质量的代码输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22230 2026-02-02 cs.LG

DAJ: Data-Reweighted LLM Judge for Test-Time Scaling in Code Generation

DAJ:用于代码生成测试时缩放的数据重加权LLM评判器

Peijia Qin, Ruiyi Zhang, Qi Cao, Pengtao Xie

机构 * ucsd(加州大学圣地亚哥分校)

AI总结 DAJ通过双层数据重加权学习框架,提升LLM评判器在代码生成测试时缩放中的性能,实现对困难问题和轨迹一致数据的自动强调,取得最佳效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11062 2026-02-02 cs.LG cs.MA

Stronger-MAS: Multi-Agent Reinforcement Learning for Collaborative LLMs

Stronger-MAS: 多智能体强化学习用于协作大语言模型

Yujie Zhao, Lanxiang Hu, Yang Wang, Minmin Hou, Hao Zhang, Ke Ding, Jishen Zhao

机构 * University of California, San Diego(加州大学圣地亚哥分校) Intel Corporation(英特尔公司)

AI总结 Stronger-MAS提出了一种针对多智能体强化学习的AT-GRPO算法,通过改进的分组策略和训练系统,在多个任务中显著提升了大语言模型的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24033 2026-02-02 cs.CL cs.CE cs.LG

Studying the Soupability of Documents in State Space Models

研究状态空间模型中文档的可合并性

Yasaman Jafari, Zixian Wang, Leon Bergen, Taylor Berg-Kirkpatrick

机构 * Department of Computer Science, University of California San Diego, San Diego, CA, USA(加州大学圣地亚哥分校计算机科学系) University of Illinois Urbana-Champaign, Champaign, IL, USA(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文提出文档融合方法,通过模块化编码提升状态空间模型在多跳问答、稀疏检索等任务中的性能,实现高效推理。

详情

展开后加载摘要…

URL PDF HTML 收藏