Continual Learning for Robotics: Definition, Framework, Learning Strategies, Opportunities and Challenges
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.LG
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.LG
专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.LG
Comments AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (AIIDE'19). arXiv admin note: text overlap with arXiv:1812.00045
专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.SE
Comments 6 pages, 0 figures
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI
Comments Accepted to the 2019 International Conference on Intelligent User Interfaces
专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI
Comments 8 pages, 7 figures
专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.LG
Comments ICML 2018
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI
Comments International Joint Conference on Artificial Intelligence (IJCAI 2018)
专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI
Comments 9 pages, 5 figures
专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI
Comments 34 pages, 7 Figures
Journal ref Logical Methods in Computer Science, Volume 2, Issue 4 (October 2, 2006) lmcs:2238
专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.AI
Journal ref Journal Of Artificial Intelligence Research, Volume 34, pages 521-567, 2009
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI
Comments Appears in Proceedings of the Fourteenth Conference on Uncertainty in Artificial Intelligence (UAI1998)
专题命中 记忆与上下文管理 :agent(abstract);planning(abstract);分类 cs.AI
Comments Appears in Proceedings of the Sixteenth Conference on Uncertainty in Artificial Intelligence (UAI2000)
专题命中 记忆与上下文管理 :agent(abstract,comments);分类 cs.AI、cs.CL、cs.LG
Comments Project page with code & videos: https://helper-agent-llm.github.io
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(comments,journal_ref);分类 cs.AI、cs.LG
Comments Published at Proc. of the 20th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2021)
Journal ref Proceedings of the 20th International Conference on Autonomous Agents and Multiagent Systems. 2021. 97-105
WorldMind:用于状态感知NPC行为的解耦游戏世界模型
机构 * Tencent(腾讯)
专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)
AI总结 本研究针对现有游戏世界模型中NPC行为与视频生成绑定的问题,提出首个解耦框架WorldMind,构建BOSS-140K数据集,实验显示其NPC行为更优。
Comments Project page: this https URL (https://teawhite.cn/worldmind_projectpage/)
Zetta ζ:用于自进化物理智能的高效闭环具身框架
机构 * Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院(AIR)) ; Z-Trans AI
专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract)
AI总结 Zetta ζ是一种闭环具身框架,通过时间尺度分离的循环进化评判器与恢复技能,结合Z-Infra在LIBERO-Pro、RoboCasa上实现90.8%、93.6%的成功率,为物理智能扩展提供路径。
FreeToken:面向边缘原生MoE服务的带宽自适应高效执行方案
专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract)
AI总结 FreeToken是边缘原生MoE服务系统,通过协同设计服务栈实现带宽自适应执行,将个人计算机转化为弹性推理平台,可在边缘硬件上部署大参数MoE模型,拓展了本地AI服务能力。
DriveVLA-M0:面向自动驾驶的故障感知记忆增强方法
机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) ; Chongqing Chang’an Technology Co., Ltd.(重庆长安科技有限公司)
专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)
AI总结 本文提出DriveVLA-M0,一种具备故障感知潜在记忆的检索增强型VLA模型,通过故障案例记忆与针对性修正机制,在NAVSIM基准上优于现有方法,实现自动驾驶性能提升。
面向具身智能体的任务状态视界的编译与基准测试
专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract)
AI总结 该研究定义任务状态视界(TSH),推出RoboGraph编译器并发布含588个情节的基准,发现多数先进智能体模型在高TSH下维护、更新任务相关状态存在差距。
Comments 32 pages, including appendices
MASS:具有权威共享状态的多人世界模型
机构 * Alaya Lab(Alaya实验室) ; Peking University(北京大学) ; Institute of Science Tokyo(东京科学大学)
专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract)
AI总结 该研究提出MASS模型,通过将世界动态与视图渲染解耦,解决现有视频世界模型在多人环境中的缺陷,在多人Snake基准测试中实现更优状态精度,为多智能体世界模拟提供实用基础。
Comments Project Page: https://alaya-lab.github.io/MASS/
WebChoreArena:在现实繁琐网页任务上评估网页浏览智能体
专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本文提出WebChoreArena,作为WebArena的扩展,包含532个耗时300多小时开发的繁琐网页任务,从大规模记忆、计算、长期记忆三维度评估网页浏览智能体,实验显示其能清晰衡量LLM进展且难度高于WebArena。
Comments COLM2026. Project Page: https://webchorearena.github.io/
明确,而非冗长:什么使认知立场在记忆压缩中留存
专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 本研究探究使认知立场在记忆压缩中留存的因素,发现将立场表述为带标签的字段可提升留存率,明确立场而非仅延长表述是关键,明确的最佳方式取决于模型。
Comments 20 pages, 3 figures, 4 tables. Code, per-trial data, and the pre-registration commit: https://github.com/collapseindex/factwash
Mimir:面向交互环境中具身智能体的、具备动态 grounding 的神经符号记忆系统
专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)
AI总结 本文提出Mimir,一种分离世界与任务记忆并具备动态grounding的神经符号记忆系统,在EB-ALFRED、EB-Habitat等具身任务中显著提升了智能体的长程执行成功率。
Comments 9 pages, 4 figures
面向基于检索的稀疏注意力的通用近内存处理异构大语言模型服务
专题命中 记忆与上下文管理 :agentic(abstract,abstract_cn)
AI总结 本文针对前沿LLM的基于检索的稀疏注意力需求,提出异构解码服务系统KARAT,结合PNM与OFMS、CMR优化,大幅提升吞吐量与每TDP性能。
编排不可逆状态转换的智能体的安全不变量:在公共账本上评估的四维形式主义
专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract)
AI总结 该研究针对编排不可逆状态转换的智能体,提出四维形式主义与七个安全不变量,在公共账本场景下验证其可提升智能体安全栈通过率,且可推广至其他不可逆状态交互场景。
Comments 29 pages, 8 figures, 7 tables
MemoryForge:为类人LLM智能体合成终身记忆
机构 * Tencent(腾讯)
专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 MemoryForge是从简短目标画像合成终身记忆的框架,通过记忆条件让冻结LLM动态检索相关记忆,在两类任务实验中使其表现更类人。
DualDecoder:通过预测预取加速长上下文大语言模型推理
专题命中 记忆与上下文管理 :agentic(abstract,abstract_cn)
AI总结 该研究针对长上下文LLM推理的内存墙瓶颈,提出轻量级服务系统DualDecoder,通过双token解码流水线预测预取关键KV条目,消除辅助状态开销,使解码吞吐量最高提升2.62倍且保留延迟与模型质量。
Semalith v1.4:一个经过校准的1.84亿参数安全分类器,在参数比Llama - Guard - 3 - 8B少44倍的情况下实现了先进的提示注入检测
专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.CL、cs.LG
AI总结 研究针对金融服务等场景中大语言模型安全分类需求,提出Semalith v1.4分类器,能单步实现三轴安全分类,经训练和对比测试,在提示注入检测上表现出色且参数少,还给出不同场景下的部署建议。
Comments 16 pages, 8 tables, no figures
高效多轮LLM推理的解耦服务
专题命中 记忆与上下文管理 :autonomous agent(abstract);planning(abstract)
AI总结 AMPD通过自适应协调预填充和解码工作负载,提升多轮LLM推理的服务级别目标达成率。
Comments ICML 2026
Critsly:用于设计教育和基于项目学习的人工制品感知人工智能批判队友
专题命中 记忆与上下文管理 :planning(abstract);workflow(abstract)
AI总结 研究针对设计教育和基于项目学习中高质量批判稀缺等问题,提出Critsly这一人工制品感知的人工智能批判工作区,结合多种功能,将AI变为批判队友,为学习者和教育者提供更优批判实例。
Comments 3 pages, Accepted submission to the 27th International Conference on Artificial Intelligence in Education Interactive Events Track