arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-27 至 2026-08-27 共收录 18 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 记忆与上下文管理 18 篇

2608.26013 2026-08-27 cs.CL 新提交 85%

VISA: Agentic Self-Evolving Data Synthesis for Multimodal Instruction Following

VISA:用于多模态指令遵循的智能体式自进化数据合成

Min Zeng, Guanxin Tan, Libin Cen, Yawei Wen, Rui Hu, Liuyang Bian, Xiaolong Chen, Xiaoxin Chen

机构 * vivo AI Lab(vivo AI实验室)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract,abstract_cn);分类 cs.CL

AI总结 VISA是一种智能体式自进化数据合成框架,通过自进化循环优化多模态指令合成,在MM-IFEval等基准上提升了多模态指令遵循性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21725 2026-08-27 cs.CL cs.AI cs.CE 版本更新 84%

AEL: Evolving Agent Harness in Open-Ended Environments

AEL:开放环境中演化的智能体 harness

Wujiang Xu, Jiaojiao Han, Minghao Guo, Kai Mei, Xi Zhu, Han Zhang, Dimitris N. Metaxas

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本研究提出双时间尺度框架AEL,将记忆使用转化为在线策略选择,在顺序投资组合和支持工单路由任务中均显著优于多种基线方法,性能提升具有因果性。

Comments EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25500 2026-08-27 cs.AI cs.CL 新提交 84%

CaSKG: Counterfactual-Causal Skill Graphs for Scalable Agent Skill Retrieval

CaSKG:用于可扩展智能体技能检索的反事实因果技能图

Zhiyuan Li, Linyuan Gao, Xuechun Ding, Hongwei Chen, Yuan Wu, Yi Chang

机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) Ant Group(蚂蚁集团)

专题命中 记忆与上下文管理 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出CaSKG框架,通过构建并校准反事实因果技能图实现可扩展智能体技能检索,在6种LLM骨干模型的两个基准测试中均取得最高任务得分,显著优于Graph-of-Skills。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11544 2026-08-27 cs.CL cs.AI 版本更新 84%

Time is Not a Label: Continuous Phase Rotation for Temporal Knowledge Graphs and Agentic Memory

时间并非标签:连续相位旋转用于时间知识图谱与智能记忆

Weixian Waylon Li, Jiaxin Zhang, Xianan Jim Yang, Tiejun Ma, Yiwen Guo

机构 * University of Edinburgh(爱丁堡大学) LIGHTSPEED University of St Andrews(圣安德鲁斯大学) Independent Researcher(独立研究员)

专题命中 记忆与上下文管理 :agentic(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 本文提出RoMem模块,通过连续相位旋转技术解决时间信息在知识图谱中的表示问题,提升时间推理和记忆保持性能,实现状态-of-the-art结果。

Comments EMNLP 2026, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25462 2026-08-27 cs.HC cs.GR 新提交 82%

TailorCoPilot: Enabling Agentic Pattern Making with Version-Controlled State Tracking

TailorCoPilot:实现带版本控制状态跟踪的智能体式制版

Yuexin Sun (1), Zhaohui Wang (1), Ruiyang Liu (2), Demian Kong (2), Qian He (2), Gaofeng He (2), Huamin Wang (2) ((1) Donghua University, (2) Style3D Research)

专题命中 记忆与上下文管理 :agentic(title,abstract);workflow(abstract)

AI总结 TailorCoPilot是基于TailorTrace版本控制后端的智能体式制版系统,可记录专家隐性制版知识,在用户研究中提升了新手的制版任务表现,为生成式AI和学徒制提供支持。

Comments To appear in UIST this http URL (http://2026.Corresponding) author: Zhaohui Wang. Project leader: Ruiyang Liu

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25553 2026-08-27 cs.IR cs.AI cs.CL 新提交 81%

When Stale Constraints Go Unchecked: Budgeted Verification Failures in Inherited Agent Memory

当过时约束未被核查:智能体继承记忆中的带预算验证失败

Kazuki Nakayashiki

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.CL

AI总结 该研究针对智能体继承记忆中过时约束未被核查的问题,建模替代机制,发现重新分配预算槽位给关键路径可显著提升当前记录一致的决策,为记忆系统设计提供了参考。

Comments 18 pages, 3 figures, 7 tables. Manuscript, LaTeX source, all 5,400 episode files, frozen specifications, timestamp proofs, analysis and generator scripts are archived at Zenodo: doi: https://doi.org/10.5281/zenodo.22108558

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25570 2026-08-27 cs.LG cs.MA 新提交 79%

Beyond Scaling: Self-Evolving LLM Agents for Hardware Kernel Optimization via an Experience-Driven Workflow and Experience Graph Memory

超越缩放:基于经验驱动工作流与经验图记忆的硬件内核优化自演进大语言模型智能体

Siyuan Chen, Runlin Hou, Shenxiu Wu, Yansong Sun, Junming Cao, Yiyu Zhang, Shudi Shao, Junhao Qiu, Zhichao Lu, Qingfu Zhang

机构 * City University of Hong Kong(香港城市大学) Huawei Technologies Ltd.(华为技术有限公司)

专题命中 记忆与上下文管理 :workflow(title);agent(abstract);分类 cs.LG

AI总结 本文提出KOPE框架,通过经验图记忆与主动上下文管理实现硬件内核优化自演进LLM智能体,在相同模型设置下其加速比、通过率等关键指标显著优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22149 2026-08-27 cs.RO cs.AI 版本更新 70%

Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

Meta-Ctrl:通过分离句法与语义约束实现带保证的规划生成

Gwen Yidou-Weng, Edward Sun, Tianyi Ma, Metin Alp Dogan, Benjie Wang, Allen Peng, Guy Van den Broeck, Yuchen Cui

机构 * Michigan State University(密歇根州立大学) University of California Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 Meta-Ctrl是一种约束解码框架,通过引入元标记分离句法与语义约束,在保证规划满足约束的同时保留语言模型的规划质量,在WAH-NL数据集和真实桌面机器人上均取得优于GPT-4的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21156 2026-08-27 cs.IR cs.AI cs.ET 版本更新 70%

Graph Engineering in the Era of LLM Agents: From Individual Intelligence to System Intelligence

大语言模型智能体时代的图工程:从个体智能到系统智能

Yuyuan Feng, Zhishang Xiang, Chaobin Yang, Qichao Ma, Zerui Chen, Yujing Zhang, Ke Huang, Chuanjie Wu, Zhaoxu Liu, Yili Wang, Xin He, Jiapu Wang, Zijin Hong, Hao Chen, Yuanchen Bei, Kun Wang, Shengyuan Chen, Ningyu Zhang, Enyan Dai, Linhao Luo, Qingyi Pan, Qi Wang, Wenqi Fan, Guangjing Wang, Na Zou, Yangqiu Song, Xin Wang, Zechao Li, Xia Hu, Qing Li, Xiao Huang, Zhihong Zhang, Jinsong Su, Qinggang Zhang, Yi Chang

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 该研究针对LLM智能体复杂任务的个体智能局限,提出图工程范式,通过构建动态图结构组织协调异构智能体,为系统智能提供统一基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16899 2026-08-27 cs.LG cs.AI 版本更新 62%

Epistemic Memory: A Validity Layer for Self-Maintaining Intelligent Systems

认知记忆:自维持智能系统的有效性层

Pin-Han Ho, Limei Peng, Yiming Miao, Yan Jiao

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文针对AI记忆机制忽略知识有效性条件导致语义坐标漂移的问题,提出认知记忆作为有效性维护层,引入OBM架构,实验表明其可提升智能体在变化观测条件下的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25618 2026-08-27 cs.CL 新提交 57%

AWM: Answerable Working Memory for Long-Document VQA Agents

AWM:面向长文档VLM智能体的可回答工作记忆

Dongzhuoran Zhou, Yuqicheng Zhu, Yule Liu, Zhen Yang, Rui Lu, Yuxiao Dong, Jie Tang, Evgeny Kharlamov

机构 * University of Oslo(奥斯陆大学) Bosch Center for AI(博世人工智能中心) University of Stuttgart(斯图加特大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Tsinghua University(清华大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.CL

AI总结 针对长文档VQA智能体的记忆质量盲区,提出AWM方法,通过融入仅记忆可回答性的GRPO奖励机制,提升了最终答案准确率并降低记忆缺失正确的比例。

Comments EMNLP 2026 Findings. 16 pages, 4 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25577 2026-08-27 cs.DB cs.AI 新提交 57%

PolyMemDB: A Polyglot Database System for AI Memory Management

PolyMemDB:一款面向AI记忆管理的多语言数据库系统

Yu Wang, Jiaheng Lu

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 针对现有智能体记忆系统的存储碎片化与事实冲突问题,推出PolyMemDB多语言数据库系统,通过多语言存储架构与概率推理引擎管理智能体记忆,以减少LLM幻觉并提升个性化体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12476 2026-08-27 cs.AI 版本更新 57%

Governed Persistent Memory: Source-Bound State Semantics and Fail-Closed Release for Long-Horizon Agents

受控持久内存:长程智能体的源绑定状态语义与故障关闭式释放

Guodong Xu

机构 * Qingdao Guodongxiansheng Network Technology Co., Ltd.(青岛果动先生网络科技有限公司)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文针对长程智能体内存的矛盾记录问题,提出受控持久内存(GPM)模型,经多组基准测试与服务评估,其在GPM-ReleaseBench、中英文指令分支等场景均实现零不匹配,修复大量基线故障且无退化。

Comments 23 pages, 2 figures, 11 tables. Includes a sealed end-to-end governed-memory service evaluation with an ungoverned local Qwen2.5-7B comparison

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02689 2026-08-27 cs.CV cs.AI 版本更新 57%

S-EMBER: A Large-Scale Benchmark for Streaming Egocentric Memory Retrieval

S-EMBER:用于流式自我中心记忆检索的大规模基准测试

Xiaodong Wang, Xuanyi Zhao, Pedro Rodriguez, Devendra Singh Sachan, Barlas Oguz, Seungwhan Moon, Shang-Wen Li, Gargi Ghosh, Xin Dong, Wen-Tau Yih

机构 * FAIR, Meta(公平研究院,元公司) Reality Labs, Meta(现实实验室,元公司)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 研究针对可穿戴设备连续第一人称记录下AI助手的情景记忆问题,引入S-EMBER基准测试,通过视频及问答对模拟真实交互,发现前沿模型存在定位矛盾,为可穿戴AI代理情景记忆发展奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.26075 2026-08-27 cs.SI 新提交 50%

Epistemic Networks, Collective Misperception, and the Manipulation of Social Knowledge

认知网络、集体误解与社会知识的操纵

Mihnea C. Moldoveanu, Joel A.C. Baum

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 该研究聚焦网络中智能体的交互信念结构,提出以相互归因张量为社会认知分析单元,揭示集体误解等现象的构成及高阶信念与认知网络游走的关联。

Comments 56 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07035 2026-08-27 cs.IR 版本更新 50%

MISO: Model-Internal-State-Guided Optimization for Ranking Models

MISO:面向排序模型的模型内部状态引导优化

Yongzhe Zhang, Xiaoyu Deng, Yifan He, Mengying Sun, Sheng Luo, Yijia Liu, Hao Yan, Zhuo Li, Huiping Yao, Swathi Hrishikesh, Jing Chen, Dennis Choi, Steven Liu, Zhiwen Chen, Yang Jin, Haoyu Zhou, Lexi Luo, Keyi Chen, Anish Khazane, Marcio Porto, Xiaoya Wang, Emmy Wang, Jiang Liu, Kangfu Zheng, Xingyuan Wang, Peggy Yao, Yi Meng, Bilal Fadlallah, Gursharan Singh, Prabhakar Goyal, Alireza Vahdatpour, Santanu Kolay

专题命中 记忆与上下文管理 :workflow(abstract)

AI总结 针对排序模型优化依赖昂贵试错的问题,提出利用模型内部状态的MISO工作流,在广告排序案例中提升归一化熵且减少验证运行,实现手动调优与自动搜索的折中。

Comments Accepted at the OARS Workshop at ACM RecSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26327 2026-08-27 econ.TH 版本更新 50%

The Last Costly Signal: How Generative AI Collapses Competence Signaling and Why Liability Sustains Markets for Expert Services

最后一个高成本信号:生成式AI如何瓦解能力信号机制,以及为何责任机制能维持专家服务市场

Andreas Bauer

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究生成式AI降低专家服务信号成本导致的市场混同问题,提出结果依赖型责任信号可恢复市场分离,还内生化合同制度并设计了相关验证实验。

Comments 39 pages, 7 figures. JEL codes: D82, D86, L15, L84, M31, O33. Simulation code and numerical results available at: this https URL (https://doi.org/10.6084/m9.figshare.33106946)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10381 2026-08-27 cond-mat.stat-mech nlin.AO 版本更新 50%

Revisiting the non-equilibrium phase transitions of the continuous-trait Axelrod model

重新审视连续性状阿克塞尔罗德模型的非平衡相变

Sandro M. Reia, Paulo R. A. Campos, José F. Fontanari

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 研究连续性状阿克塞尔罗德模型的非平衡相变,通过分析中位数缩放和概率分布揭示其相变特征,发现\(F = 2\)时为混合转变,\(F = 3\)时为非混合一阶转变,还应用于离散泊松变体建立统一表征。

详情

展开后加载摘要…

URL PDF HTML 收藏