arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-26 至 2026-01-26 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 8 篇

2601.12771 2026-01-26 cs.CL 90%

Who Does This Name Remind You of ? Nationality Prediction via Large Language Model Associative Memory

这个名字让你想起谁?通过大语言模型关联记忆进行国籍预测

Keito Inoshita

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 LAMA通过利用大语言模型的关联记忆能力,有效提升国籍预测任务的准确性,其双代理架构在处理不同知识领域时表现出互补优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16621 2026-01-26 cs.CL 85%

How Does Personalized Memory Shape LLM Behavior? Benchmarking Rational Preference Utilization in Personalized Assistants

个性化记忆如何塑造大语言模型行为?个性化助手中的理性偏好利用基准测试

Xueyang Feng, Weinan Gan, Xu Chen, Quanyu Dai, Yong Liu

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出RPEval基准,通过分析个性化记忆对LLM行为的影响,引入RP-Reasoner方法,有效缓解非理性个性化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11595 2026-01-26 cs.DC cs.LG cs.SE 81%

Enhancing Model Context Protocol (MCP) with Context-Aware Server Collaboration

增强模型上下文协议(MCP)的上下文感知服务器协作

Meenakshi Amulya Jayanti, X. Y. Han

机构 * University of Chicago(芝加哥大学)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本研究提出CA-MCP,通过引入共享上下文存储提升多智能体系统效率,减少LLM调用次数和响应失败频率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15324 2026-01-26 cs.AI 79%

Prometheus Mind: Retrofitting Memory to Frozen Language Models

Prometheus Mind:为冻结语言模型添加记忆

Mark Wind

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.AI

AI总结 Prometheus Mind通过11个模块化适配器为冻结的Qwen3-4B模型添加记忆,解决提取、训练、注入和隐藏状态崩溃四个问题,实现94.4%的检索准确率。

Comments 28 pages, corrected some inconsistentsies and some edits

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16649 2026-01-26 cs.AI 70%

LUMINA: Long-horizon Understanding for Multi-turn Interactive Agents

LUMINA:多轮交互智能体的长视图理解

Amin Rakhsha, Thomas Hehn, Pietro Mazzaglia, Fabio Valerio Massoli, Arash Behboodi, Tribhuvanesh Orekondy

机构 * University of Toronto(多伦多大学) Qualcomm AI Research(高通人工智能研究)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 LUMINA研究通过oracle反事实框架分析多轮交互智能体中各基础能力的重要性,揭示了不同技能在不同环境下的有效性差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16238 2026-01-26 cs.SE cs.AI cs.LG 62%

VibeTensor: System Software for Deep Learning, Fully Generated by AI Agents

VibeTensor:由AI代理完全生成的深度学习系统软件

Bing Xu, Terry Chen, Fengzhe Zhou, Tianqi Chen, Yangqing Jia, Vinod Grover, Haicheng Wu, Wei Liu, Craig Wittenbrink, Wen-mei Hwu, Roger Bringmann, Ming-Yu Liu, Luis Ceze, Michael Lightstone, Humphrey Shi

机构 * NVIDIA

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 VibeTensor是首个由AI代理完全生成的深度学习系统软件,实现了PyTorch风格的张量库及CUDA内存管理,展示了AI辅助软件工程的里程碑进展。

Comments Open-source: https://github.com/NVLabs/vibetensor

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16690 2026-01-26 cs.CL cs.CV 57%

EMemBench: Interactive Benchmarking of Episodic Memory for VLM Agents

EMemBench: 交互式评估VLM代理情景记忆的基准测试

Xinze Li, Ziyue Zhu, Siyuan Liu, Yubo Ma, Yuhang Zang, Yixin Cao, Aixin Sun

专题命中 长上下文与记忆 :prompting(abstract);分类 cs.CL

AI总结 EMemBench通过交互式游戏评估VLM代理的情景记忆,发现归纳和空间推理在视觉设置中仍是瓶颈,且持续记忆对文本游戏有明显提升,但对VLM代理的提升不一致。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16973 2026-01-26 cs.CV 50%

VisGym: Diverse, Customizable, Scalable Environments for Multimodal Agents

VisGym: 多模态代理的多样化、可定制化、可扩展环境

Zirui Wang, Junyi Zhang, Jiaxin Ge, Long Lian, Letian Fu, Lisa Dunlap, Ken Goldberg, XuDong Wang, Ion Stoica, David M. Chan, Sewon Min, Joseph E. Gonzalez

专题命中 长上下文与记忆 :language model(abstract)

AI总结 VisGym通过多样化环境评估多模态代理在多步视觉决策中的表现,揭示模型在长上下文处理和视觉化任务中的局限性。

Comments Project page: https://visgym.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏