arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-28 至 2026-08-28 共收录 15 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 15 篇

2608.26013 2026-08-28 cs.CL 版本更新 85%

VISA: Agentic Self-Evolving Data Synthesis for Multimodal Instruction Following

VISA:用于多模态指令遵循的智能体式自进化数据合成

Min Zeng, Guanxin Tan, Libin Cen, Yafei Wen, Rui Hu, Liuyang Bian, Xiaolong Chen, Xiaoxin Chen

机构 * vivo AI Lab(vivo AI实验室)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract,abstract_cn);分类 cs.CL

AI总结 VISA是一种智能体式自进化数据合成框架,通过自进化循环优化多模态指令合成,在MM-IFEval等基准上提升了多模态指令遵循性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26895 2026-08-28 cs.IR cs.AI 新提交 83%

When Memory Takes Gradients: Collaborative Vector Memory for Agentic Recommender Systems

当记忆获取梯度:面向智能体推荐系统的协同向量记忆

Hanchong Chen, Xing Tang, Lingjie Li, Xiongfeng Shan, Xiuqiang He

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究针对智能体推荐系统中文本记忆的局限,提出CoVeMem协同向量记忆方法,在四个推荐基准上多数指标优于现有文本记忆智能体,无需额外LLM调用即可利用完整交互历史优化模型。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26263 2026-08-28 cs.AI cs.MA 新提交 83%

SKILL.state: Scalable Long-Horizon Agent Skills

SKILL.state:可扩展的长程智能体技能

Sanket Badhe, Priyanka Tiwari, Jonghyun Chung

机构 * Google LLC(谷歌公司) Purdue University(普渡大学)

专题命中 记忆与上下文管理 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI

AI总结 针对现有智能体运行时的长程延迟与上下文污染问题,提出SKILL.state架构,用显式可变执行状态替代追加式对话历史,提升任务准确率并降低令牌消耗。

Comments accepted at EMNLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25462 2026-08-28 cs.HC cs.GR 版本更新 82%

TailorCoPilot: Enabling Agentic Pattern Making with Version-Controlled State Tracking

TailorCoPilot:实现带版本控制状态跟踪的智能体式制版

Yuexin Sun, Zhaohui Wang, Ruiyang Liu, Demian Kong, Qian He, Gaofeng He, Huamin Wang

专题命中 记忆与上下文管理 :agentic(title,abstract);workflow(abstract)

AI总结 TailorCoPilot是基于TailorTrace版本控制后端的智能体式制版系统,可记录专家隐性制版知识,在用户研究中提升了新手的制版任务表现,为生成式AI和学徒制提供支持。

Comments To appear in ACM Symposium on User Interface Software and Technology (UIST 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27141 2026-08-28 cs.CR cs.AI 新提交 81%

Safety Does Not Compose: Non-Decaying Loop State for Autonomous LLM Agents

安全性无法组合:自主大型语言模型智能体的非衰减循环状态

Chenhao Wu, Haoxuan Jia, Yang Liu, Yingguang Yang, Yuhan Lin, Chongyang Zhang, Hao Zheng, Yulin Huang, Jianshen Zhang, Yongzhi Qi, Shang Luo, Kefu Xu, Jifeng Zhu, Bin Chong

专题命中 记忆与上下文管理 :agent(summary_cn,abstract);分类 cs.AI

AI总结 该研究发现自主LLM智能体的轨迹级安全保障存在组合性缺陷,提出非衰减循环安全状态的LoopHarness方案,可限制未授权不可逆操作数量,通过Agent-SafetyBench等评估验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25553 2026-08-28 cs.IR cs.AI cs.CL 版本更新 81%

When Stale Constraints Go Unchecked: Budgeted Verification Failures in Inherited Agent Memory

当过时约束未被核查:智能体继承记忆中的带预算验证失败

Kazuki Nakayashiki

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 该研究针对智能体继承记忆中过时约束未被核查的问题,建模替代机制,发现重新分配预算槽位给关键路径可显著提升当前记录一致的决策,为记忆系统设计提供了参考。

Comments 21 pages, 3 figures, 7 tables. v2: claim-calibration revision (outcome-construct wording, native missed-path-rate terminology, bundled-policy estimand, execution-structure disclosure); no data, estimates or figures changed. Manuscript, LaTeX source, all 5,400 episode files, frozen specifications, timestamp proofs and scripts are archived at Zenodo: doi: https://doi.org/10.5281/zenodo.22117197

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26983 2026-08-28 cs.AI 新提交 74%

GraphMemix: Query-Aware Evidence Forests for Long-Term Multimodal Agent Memory

GraphMemix:面向多模态智能体长期记忆的查询感知证据森林

Geng Li, Yuhao Wang, Dong Li, Jianye Hao, Yuxin Peng

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机研究所) MemoraX AI(MemoraX人工智能公司)

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI

AI总结 GraphMemix作为组合优化图记忆框架,通过三个关键组件构建查询感知证据森林,在四个多模态记忆基准上提升了准确率并建立了新的帕累托前沿。

Comments Project page with code: this https URL (https://github.com/ligeng0197/graphmemix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26991 2026-08-28 cs.AI 新提交 70%

ASIL: Replacing Screenshot-and-Click with Structured State and Semantic Actions

ASIL:用结构化状态与语义动作替代截图点击

Rui Xie, Lu Chen

机构 * Shanghai Jiao Tong University(上海交通大学) BIGAI(北京智源人工智能研究院)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出ASIL智能体-软件交互层,以结构化状态与语义动作替代低效的截图点击界面,在多应用基准任务中表现优于截图点击,还可提升Qwen系列模型的性能。

Comments Accepted to Findings of EMNLP 2026. 19 pages, 7 figures: 9-page main paper followed by limitations, ethics, acknowledgments, references, and appendices A-E. Project page: this https URL (https://sharryxr.github.io/ASIL/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26295 2026-08-28 cs.CL cs.AI cs.MA cs.SE 新提交 67%

MemToC: Benchmarking Memory-Tool Conflict Resolution in Large Language Models

MemToC:大型语言模型中记忆-工具冲突解决的基准测试

Arseniy Varlamov, Rishat Zinnatullin, Elisei Rykov, Alexander Panchenko, Ilseyar Alimova

机构 * Central University(中央大学) Ural Federal University(乌拉尔联邦大学) Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究院) AIRI(人工智能研究院(AIRI))

专题命中 记忆与上下文管理 :tool use(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 该研究提出MemToC基准,测试工具增强型LLM在记忆与工具返回冲突时的仲裁能力,发现指令调优模型在多数情况遵循工具,微调可改善仲裁但需兼顾工具使用与弃权表现。

Comments 26 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26730 2026-08-28 cs.AI 新提交 57%

Knowing When Not to Reuse: Conditional Experience Transfer in Autonomous LLM Post-Training

知晓何时不重用:自主大语言模型后训练中的条件经验迁移

Tingyun Li, Wenfeng Feng, Weiqing Li, Abudukelimu Wuerkaixi, Guohua Liu, Yuewei Zhang

机构 * Alibaba Cloud Computing(阿里巴巴云计算)

专题命中 记忆与上下文管理 :function calling(abstract);分类 cs.AI

AI总结 本研究针对自主大语言模型后训练中经验重用的决策问题,提出BCIT方法,通过绑定效果上下文、检查条件等减少有害更新,提升模型质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04562 2026-08-28 cs.AI cs.NE 版本更新 57%

Heaviside Continuity of Rolling Coefficients for Eliminating Epistemic Entropy in Large Language Models

用于消除大语言模型认知熵的滚动系数的海维赛德连续性

MY Pitsane, Hope Mogale

机构 * North-West University, RSA(南非北开普大学) University of Pretoria, RSA(南非彼得里亚大学) Mankind Research Labs, Sandton(沙顿人类研究实验室)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 研究大语言模型输出难检测错误的问题,提出海维赛德连续性的滚动系数框架,将推理重新表述为谓词门控状态转换,结合模型置信度与并行验证信号,防止无效状态传播,降低认知熵。

Comments Major revisions are going to be implemented and the paper will be restored later

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.27215 2026-08-28 cs.CR 新提交 50%

From Security Events to Conflict States: A Three-layer Cyber Defense Scenario Model for Enhanced Cyber Situational Awareness

从安全事件到冲突状态:用于增强网络态势感知的三层网络防御场景模型

Miguel Requena Micó, Mario Fernandez-Tarraga, Daniel Díaz-López, Sergio López Bernal, Gregorio Martínez Pérez

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出一种面向任务的网络防御框架,基于三层集成概率模型与NetLogo仿真原型,可增强网络态势感知,经多维度评估验证其能实现攻击进程、不确定性管理等环节的连贯关联。

Comments 18 pages, 3 figures, 1 table, paper in proceedings of The International Conference on Availability, Reliability and Security, ARES 2026 in Linkoping, Sweden, August 24-27, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.25061 2026-08-28 cond-mat.mtrl-sci physics.geo-ph 版本更新 50%

Learning and retrieval for warm-starting charge-self-consistent DFT+DMFT

基于物理约束的自能预热方法用于电荷自洽DFT+DMFT:铁在核心条件下的应用

Rishi Rao, Li Zhu

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 本文提出了一种基于物理约束的机器学习预热方法,用于电荷自洽的DFT+DMFT计算,通过预测局部自能和费米能的紧凑实值表示,提高了铁、FeO和NiO等材料的DMFT迭代效率,从而在核心条件下确定铁的熔化曲线。

Comments 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16522 2026-08-28 cs.RO cs.MA 版本更新 50%

A Mechanistic Model for Collective Motion from Sensorimotor Regularities

从传感器运动规律出发的集体运动机制模型

Vito Mengers, Bao Duc Cao, Oliver Brock

机构 * Robotics and Biology Laboratory, Technische Universität Berlin, Germany(技术大学柏林机器人与生物学实验室,德国) Science of Intelligence, Research Cluster of Excellence, Berlin, Germany(智能科学,卓越研究集群,柏林,德国) Robotics Institute Germany(德国机器人研究所)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出基于机器人建模框架的集体运动机制模型,通过感知和动作的梯度下降实现群体行为,揭示了传感器运动规律在集体行为中的作用。

Comments Accepted at SAB26

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09375 2026-08-28 math.OC 版本更新 50%

Linear Quadratic Mean Field Games under Heterogeneous Erroneous Initial Information

存在异质错误初始信息的线性二次平均场博弈

Yuxin Jin, Lu Ren, Wang Yao, Xiao Zhang

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究针对存在异质错误初始信息的线性二次平均场博弈,推导了有限维误差通道表示、成本恒等式及近似精度,明确了确定性与随机动力学下误差对平均场及成本的影响机制。

详情

展开后加载摘要…

URL PDF HTML 收藏