arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-16 至 2026-01-16 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 长上下文与记忆 8 篇

2601.09714 2026-01-16 cs.CL cs.AI 86%

Evaluating Novelty in AI-Generated Research Plans Using Multi-Workflow LLM Pipelines

利用多工作流LLM管道评估AI生成的研究计划新颖性

Devesh Saraogi, Rohit Singhee, Dhruv Kumar

机构 * Birla Institute of Technology and Science, Pilani, India(比拉理工学院和科学学院,皮兰迪)

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文通过多工作流LLM管道评估AI生成研究计划的新颖性,发现递归分解和长上下文工作流在新颖性和可行性方面表现更优。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09913 2026-01-16 cs.AI cs.IR 85%

Continuum Memory Architectures for Long-Horizon LLM Agents

连续记忆架构用于长周期大语言模型智能体

Joe Logan

机构 * Mode7 GK Tokyo, Japan(Mode7 GK东京)

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 连续记忆架构通过持久存储和动态更新机制,解决了长周期大语言模型智能体在记忆积累、修改和消歧方面的局限性,同时揭示了该架构在延迟、漂移和可解释性方面的挑战。

Comments 10 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18691 2026-01-16 cs.CL 79%

Investigating LLM Capabilities on Long Context Comprehension for Medical Question Answering

探究大语言模型在医疗问答中的长上下文理解能力

Feras AlMannaa, Talia Tseriotou, Jenny Chim, Maria Liakata

机构 * Istanbul Aydın University(伊斯坦布尔阿迪兰大学) Queen Mary University of London(伦敦女王学院) The Alan Turing Institute(艾伦·图灵研究所)

专题命中 长上下文与记忆 :LLM(title,abstract);分类 cs.CL

AI总结 本研究探讨大语言模型在医疗问答中处理长上下文任务的能力,分析了模型大小、记忆问题及RAG方法的效果,揭示了其在不同任务中的优势与限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09723 2026-01-16 cs.CL cs.AI 79%

SagaScale: A Realistic, Scalable, and High-Quality Long-Context Benchmark Built from Full-Length Novels

SagaScale: 一种真实、可扩展且高质量的长上下文基准,基于完整小说构建

Guancheng Du, Yong Hu, Wenqing Wang, Yaming Yang, Jiaheng Gao

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 SagaScale基于完整小说构建,提供长上下文基准,通过自动化数据收集管道,评估12个LLMs和三种方法,揭示LLM在长上下文处理中的表现差异及Agentic RAG的改进效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10681 2026-01-16 cs.AI 77%

Structure and Diversity Aware Context Bubble Construction for Enterprise Retrieval Augmented Systems

结构与多样性感知的上下文气泡构建方法用于企业检索增强系统

Amir Khurshid, Abhishek Sehgal

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种结构感知和多样性约束的上下文气泡构建方法,以提高企业检索增强系统中上下文的效率和信息完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09760 2026-01-16 cs.SE cs.AI 77%

Investigating Tool-Memory Conflicts in Tool-Augmented LLMs

探究工具增强大语言模型中的工具-记忆冲突

Jiali Cheng, Rui Pan, Hadi Amiri

机构 * University of Massachusetts Lowell(马萨诸塞大学洛约拉分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

AI总结 本文提出工具-记忆冲突的概念,发现现有LLMs在STEM任务中存在该问题,并评估了现有解决方法的不足。

Comments R2-FM Workshop @ ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10798 2026-01-16 cs.CL cs.AI 73%

Judge Q: Trainable Queries for Optimized Information Retention in KV Cache Eviction

Judge Q: 用于优化KV缓存淘汰信息保留的可训练查询

Yijun Liu, Yixuan Wang, Yuzhuang Xu, Shiyu Ji, Yang Xu, Qingfu Zhu, Wanxiang Che

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 Judge Q通过引入软令牌列表,优化KV缓存淘汰中的信息保留,提升解码质量与性能表现。

Comments Accepted in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10253 2026-01-16 cs.HC cs.SE 50%

Developer Interaction Patterns with Proactive AI: A Five-Day Field Study

开发者与前瞻性AI的交互模式:一项为期五天的实地研究

Nadine Kuo, Agnia Sergeyuk, Valerie Chen, Maliheh Izadi

专题命中 长上下文与记忆 :prompting(abstract)

AI总结 本研究通过五天实地观察,揭示开发者对前瞻性AI建议的接受模式,发现干预时机和上下文对使用效果有显著影响。

Comments 14 pages, 6 figures, accepted to IUI'26

详情

展开后加载摘要…

URL PDF HTML 收藏