arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-25 至 2026-08-25 共收录 381 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. GUI与网页智能体 15 篇

2608.22678 2026-08-25 cs.RO cs.AI cs.CV 新提交 57%

RACO: Reliability-Aware Coarse-Goal Optimization for Inspection-Oriented UAV Vision-Language Navigation

RACO:面向巡检的无人机视觉语言导航的可靠性感知粗目标优化

Sen Wang, Yiming Sun, Jiaxuan He, Pengfei Zhu

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 针对面向巡检的无人机视觉语言导航,提出RACO框架,通过可靠性感知优化粗目标,在未见场景下较HETT基线显著提升成功率,改善巡检区域到达率并降低错误验证风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21830 2026-08-25 cs.AI 新提交 57%

Beyond Success and Failure: Length-Aware Contrastive Learning for GUI Agents

超越成功与失败:面向GUI智能体的长度感知对比学习

Chengyang Gu, Le Zhang, Jingbo Zhou, Yize Chen, Yu Shi, Siqi Bao, Zheng-Fan Wu, Hua Wu, Hui Xiong

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Baidu Inc.(百度公司) University of Alberta(阿尔伯塔大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 针对GUI智能体现有对比RLVR方法无法捕获轨迹细粒度质量差异的问题,提出LACL-GUI框架,引入轨迹级质量信号,在基准测试中实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07008 2026-08-25 cs.CV cs.LG 版本更新 57%

Where Not to Learn: Prior-Aligned Training with Subset-based Attribution Constraints

不应学习的地方:基于子集归因约束的先验对齐训练以实现可靠的决策制定

Ruoyu Chen, Shangquan Sun, Xiaoqing Guo, Kangwei Liu, Sanyi Zhang, Zhangcheng Wang, Shiming Liu, Qunli Zhang, Wei Wang, Hua Zhang, Xiaochun Cao

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Chinese Academy of Sciences(中国科学院大学) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) Department of Computer Science, Hong Kong Baptist University(香港 Baptist 大学计算机科学系) Communication University of China(中国传媒大学) Imperial College London(伦敦帝国学院) School of Cyber Science and Technology, Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区网络科学与技术学院)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出了一种基于归因的先验对齐方法,通过子集选择归因技术约束模型依赖于人类先验区域,从而提升决策的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22828 2026-08-25 cs.CV 新提交 50%

VeCAS: Vessel-Focused Contrast-Free Angiogram Synthesis for Vascular Interventions

VeCAS:面向血管介入的聚焦血管的无造影剂血管造影合成

De-Xing Huang, Chen-Yu Wang, Hao Liang, Xiao-Hu Zhou, Mei-Jiang Gui, Tian-Yu Xiang, Qin-Yi Zhang, Chen Wang, Xiao-Liang Xie, Shi-Qi Liu, Ming-Yuan Liu, Zhen-Chang Wang, Zeng-Guang Hou

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出VeCAS框架,通过两阶段合成实现无造影剂血管造影,在下肢数据集实验中优于对比方法,还可缩短机器人导丝导航的时间与步骤,具临床应用潜力。

Comments 10 pages, 8 figures, 5 tabels, supplementary material: https://dxhuang-casia.github.io/data/vecas_supplementary_material.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21387 2026-08-25 cs.RO cs.SY eess.SY 新提交 50%

Multimodal-Language-Model-Driven Interaction and Companionship for Service Robots in Elderly-Care Facilities

面向养老机构服务机器人的多模态语言模型驱动的交互与陪伴

Ching-Chieh Liu, Cong-Thanh Vu, Yen-Chen Liu

机构 * National Cheng Kung University (NCKU)(成功大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 该研究针对养老机构服务机器人缺乏综合陪伴与安全能力的问题,提出整合主动视觉跟人、LLM语音交互及VLM安全监测的智能陪伴机器人系统,实验验证其跟随交互与跌倒检测的有效性。

Comments Accepted to the 2026 IEEE/ASME International Conference on Advanced Intelligent Mechatronics (AIM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04276 2026-08-25 econ.TH 版本更新 50%

The Fallback as Signal: Preserved Human Skill, Liability, and Competence Signaling in Credence-Good Markets under Improving AI

作为信号的弃权:AI不断改进下的信任品市场中保留的人类技能、责任与能力信号

Andreas Bauer

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 该研究针对AI改进但仍不完善时企业的人类员工参与决策问题,构建基于主体的市场模型再现相关分析阈值,揭示信任品市场中人类技能等信号的保留机制。

Comments 51 pages, 7 figures. v3: corrections to the proofs in Appendices A and B (no reported number changes); Proposition 8 strengthened to an unconditional result with a closed-form threshold; declarations block added. Replication package: https://doi.org/10.6084/m9.figshare.33317559

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16537 2026-08-25 cs.RO 版本更新 50%

Nori A3: A Bimanual Mobile Manipulator at the Appliance Price Point

Nori Bot:一款不到1000美元的 floor-to-counter 移动机械臂

Antonio Li

机构 * LeRobot

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 Nori Bot 通过600mm Z轴提升、Raspberry Pi 4与OpenClaw协同控制以及软件安全栈解决移动机械臂的三大限制,成本仅为同类商业平台的3%。

Comments 5 pages, 4 figures, 2 tables. Supersedes arXiv:2605.16537, which described an earlier prototype on a different mechanical base

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23772 2026-08-25 cs.HC 版本更新 50%

PageGuide: Browser extension to assist users in navigating a webpage and locating information

PageGuide: 一款辅助用户在网页上导航和查找信息的浏览器扩展

Tin Nguyen, Thang T. Truong, Runtao Zhou, Trung Bui, Chirag Agarwal, Anh Totti Nguyen

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 PageGuide通过视觉叠加将LLM回答与HTML DOM结合,帮助用户快速定位信息、逐步指导操作并隐藏干扰内容,提升浏览效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11250 2026-08-25 cs.CR cs.CV 版本更新 50%

Environmental Injection Attacks against GUI Agents in Realistic Dynamic Environments

针对现实动态环境中的GUI代理的环境注入攻击

Yitong Zhang, Ximo Li, Liyi Cai, Jia Li

机构 * College of AI, Tsinghua University(清华大学人工智能学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Computer Science, Peking University(北京大学计算机学院)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出Chameleon框架,通过LLM驱动的环境模拟和注意力黑洞机制,有效暴露GUI代理在动态环境中的隐藏漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 记忆与上下文管理 29 篇

2608.22752 2026-08-25 cs.AI cs.IR 新提交 88%

The Compaction Cliff in Long-Running AI Agent Memory

长期运行AI智能体记忆中的压缩 cliff

Saber Zerhoudi, Jelena Mitrovic, Michael Granitzer

机构 * University of Passau(帕绍大学) IT:U

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 针对AI智能体记忆压缩时安全规则保留率骤降的压缩cliff问题,提出Knowledge Triage框架,通过三类算子优化上下文管理,在多基准测试中优于现有方法,并发布了相关数据集与工具。

Journal ref Proceedings of the 35th ACM International Conference on Information and Knowledge Management (CIKM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23268 2026-08-25 cs.CV 新提交 86%

Dual-Grained Agent Memory and Shapley Context Attribution for Multimodal Agentic Learner

面向多模态智能体学习者的双粒度智能体记忆与Shapley上下文归因

Jieke Wang, Tiancheng Shen, Yibo Yang, Ming-Hsuan Yang

机构 * UC Merced(加州大学默塞德分校) Shanghai Jiao Tong University(上海交通大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(title)

AI总结 针对多模态大模型推理不足的问题,提出双粒度智能体记忆框架DG-Mem,结合Shapley上下文归因,在多个数学多模态推理数据集上实现性能提升,且无需参数更新即可适配各类骨干模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22215 2026-08-25 cs.CL 新提交 85%

Dual-Layer Agentic Memory with Fast Write Routing and Slow Consolidation

带有快速写入路由与慢速整合的双层智能体记忆

Wenzhi Li, Dong Nie, Rui Lan, Tongtong Lyu, Peiyao Wang, Lingzi Hong, Weihang Pan, Boyuan Pan, Yao Hu

机构 * Zhejiang University(浙江大学) Xiaohongshu(小红书) University of North Texas(北得克萨斯大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.CL

AI总结 该研究针对LLM智能体动态环境下的记忆管理问题,提出双层智能体记忆框架,通过成本感知路由与周期性整合实现高效记忆处理,在保留高检索性能的同时减少冗余。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21810 2026-08-25 cs.LG cs.CV 新提交 85%

MSM-Mem: A Universal Medical Structured Multimodal Memory Framework for Medical AI Agents

MSM-Mem:面向医疗AI智能体的通用医疗结构化多模态记忆框架

Md Asaduzzaman Jabin, Khoa Le, Lin Zhao, Tianming Liu

机构 * University of Georgia(佐治亚大学) New Jersey Institute of Technology(新泽西理工学院)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.LG

AI总结 针对现有医疗AI智能体无法内化临床经验的问题,提出MSM-Mem框架,整合多类型临床经验并逐步更新,经MoE-LLaVA评估可提升性能,助力医疗AI智能体随实践进化推理能力。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17007 2026-08-25 cs.AI 版本更新 83%

SkillEffect: Checked Lowering for Memory-Bounded Agent Tools

SkillEffect:面向内存受限智能体工具的经校验的降阶机制

Yinuo Wang, Yiyu Shi

机构 * Sichuan University(四川大学) University of Notre Dame(圣母大学)

专题命中 记忆与上下文管理 :agent(title,abstract);tool use(abstract);分类 cs.AI

AI总结 本文提出SkillEffect架构,通过经校验降阶运行时与独立校验器,在智能体工具调度时强制实施异构内存关系,可降低峰值内存并提升固定内存上限下的任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23471 2026-08-25 cs.CR cs.AI 新提交 79%

InjecMEM: Memory Injection Attack on LLM Agent Memory Systems

InjecMEM:针对大语言模型智能体记忆系统的内存注入攻击

Hanling Tian, Gengyu Zhang, Zeyang Sha, Jingying Wang, Yuhang Liu, Zhehao Huang, Kun Yang, Xiaolin Huang

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究提出InjecMEM内存注入攻击,无需访问LLM智能体内存存储,通过特定锚点与对抗性命令引导后续查询输出,在多模型上验证了其有效性,为智能体内存安全研究提供了可复现框架。

Comments 29 pages, 3 figures. Accepted at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22767 2026-08-25 cs.AI 新提交 79%

The Retriever Should Remember: Experience-Amortized Reranking for Long-Term Agent Memory

检索器应当记忆:面向智能体长期记忆的经验摊销重排序

Qi Feng, Chris Ding, Jicong Fan

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 针对长期语言模型智能体检索器不积累经验的问题,提出EARM框架,结合观测与估计评分重排序,提升答案准确率并降低LLM重排序推理开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22339 2026-08-25 cs.CL 新提交 79%

When Not to Imitate: Boundary-Aware Skill Memory for Reliable Tool-Use LLM Agents

何时不应模仿:面向可靠工具使用大语言模型智能体的边界感知技能记忆

Zihan Lin, Zhenyu Chen, Jiawen Wei, Xiaohan Wang, Jie Cao, Jiajun Chai, Wei Lin, Guojun Yin, Ran He

机构 * Meituan(美团) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉科学学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Zhongguancun Academy(中关村学院)

专题命中 记忆与上下文管理 :tool-use(title);agent(abstract);分类 cs.CL

AI总结 针对LLM智能体仅从成功轨迹提取技能会陷入「技能模仿陷阱」的问题,提出边界感知技能记忆(BASM),通过补充边界字段提升工具使用可靠性,在多基准测试中显著优于基线方法。

Comments Accepted by EMNLP2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22310 2026-08-25 cs.AI 新提交 79%

HERO: Human-profile Enhanced Retrieval Optimization Framework for Long-term Agent Memory

HERO:面向智能体长期记忆的人像增强检索优化框架

Yuanhua Lin, Yile Li, Zhiyuan Zhao, Jing Shang, Jian Sun

机构 * China Mobile Information Technology Co., Ltd.(中国移动信息技术有限公司)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本研究提出HERO框架,通过异构记忆图保留原始对话文本,结合人像优化检索,在两个基准数据集上提升了智能体的事实与个性化推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20920 2026-08-25 cs.CL 版本更新 79%

ForeDreamer: A Self-Evolving Dual-Agent Memory Architecture for Future Event Prediction

ForeDreamer:用于未来事件预测的自进化双智能体记忆架构

Linhao Zhong, Zongze Du, Linyu Wu, Yu Bo, Hourong Li, Chenchen Jing, Hao Chen, Yuling Xi, Chunhua Shen

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) National University of Singapore(新加坡国立大学) Zhejiang University of Technology(浙江工业大学)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 针对开放网络未来事件预测的不足,提出自进化双智能体框架ForeDreamer,分离事实与经验记忆,经Prophet Arena、FutureX实验验证其有效性

Comments accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25002 2026-08-25 cs.CR 版本更新 78%

MemMark: State-Evolution Attribution Watermarking for Agent Long-Term Memory Systems

MemMark: 面向智能体长期记忆系统的状态演化归属水印

Haobo Zhang, Xutao Mao, Guangyuan Dong, Ziwei Li, Xuanbo Su, Kaijie Chen, Jing Yang, Zheng Lin

专题命中 记忆与上下文管理 :agent(title,abstract)

AI总结 提出MemMark水印方法,通过嵌入所有者控制的信号到潜在记忆写入决策中,实现无需日志、可见输出或可信元数据的快照归属,并在多个基准上保持记忆效用。

Comments Accepted to findings of EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21867 2026-08-25 cs.AI cs.CL 新提交 76%

MemGuard: Persisting Verifier Signals for LLM-Agent Memory Governance

MemGuard:为大语言模型智能体记忆治理保留验证器信号

Haoyu Wang, Guangyuan Dong, He Liang, Zijing Zhang, Jiachen Luo, Chuang Liu, Chao Xue, Hao Tang

机构 * Nankai University(南开大学) National University of Singapore(新加坡国立大学) Shanghai Institute of Optics and Fine Mechanics, Chinese Academy of Sciences(中国科学院上海光学精密机械研究所) Peking University(北京大学) Technical University of Munich(慕尼黑工业大学) Queen Mary University of London(伦敦大学玛丽女王学院) Wuhan University(武汉大学) University of New South Wales(新南威尔士大学)

专题命中 记忆与上下文管理 :agent(title);分类 cs.AI、cs.CL

AI总结 针对LLM智能体记忆的不可靠准入与漂移问题,提出MemGuard方法,通过保留验证器的生命周期元数据提升多任务基准的成功指标与效率,效果优于现有基线。

Comments 30 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24772 2026-08-25 cs.AI cs.CL 版本更新 73%

RSMeM: Knowledge-Enhanced Memory Evolution for Remote Sensing Agents with Systematic Evaluation

RSMeM:用于遥感智能体的知识增强记忆进化及系统评估

Bingxian Wu, Yu Zhang, Zonghao Guo, Tang Liu, Chen Qian, Yuxiang Lu, Xingbo Du, Yanghao Li, Yidan Zhang, Chi Chen, Ling Yao, Maosong Sun

专题命中 记忆与上下文管理 :tool-use(abstract);planning(abstract);分类 cs.AI、cs.CL

AI总结 研究针对现有遥感智能体问题,提出RSMeM机制,通过分层知识基础和失败感知经验提炼两个组件,迭代吸收领域知识转化为执行经验,经实验验证能提升工具使用性能和答案质量,具有强大知识密度。

Comments Accepted to ACL 2026 Main. 18 pages. Added links to the GitHub repository and ModelScope Studio below the title; technical content and results remain unchanged. Code: https://github.com/AI9Stars/RSMeM. Demo: https://modelscope.cn/studios/wbx929/RSMeM

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.13438 2026-08-25 cs.AI cs.CL 版本更新 73%

CogniFold: Always-On Proactive Memory via Cognitive Folding

CogniFold: 通过认知折叠实现始终在线的主动记忆

Suli Wang, Yiqun Duan, Yu Deng, Rundong Zhao, Dai Shi, Minghua Deng, Chen Chen, Yiqi Wang, Xinliang Zhou

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 提出CogniFold,一种受大脑启发的主动记忆系统,通过将互补学习系统扩展为三层(海马体、新皮层、前额叶意图层)并利用图拓扑自组织,实现事件流的持续认知结构涌现,在认知评估和常规记忆基准上均表现优异。

Comments Code is available at https://github.com/OpenNorve/CogniFold

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22725 2026-08-25 cs.AI 新提交 70%

SEAM: Shot Entity-Attribute Memory for Consistent Short-Drama Generation at Scale

SEAM:用于大规模一致短剧生成的镜头实体-属性记忆

Jiaqi Liu, Maolin Ran, Xiaoyang Lu, Jian Wang, Weiwen Liu, Jianghao Lin, Yong Yu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) CreativeFitting

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 针对大规模短剧生成的视觉连续性瓶颈,提出无训练的SEAM记忆图,在SEAM-Bench上提升连续性召回率,部署后获96.5%导演接受率。

Comments Preprint. 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22149 2026-08-25 cs.RO cs.AI 新提交 70%

Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

Meta-Ctrl:通过分离句法与语义约束实现带保证的规划生成

Gwen Yidou-Weng, Edward Sun, Tianyi Ma, Metin Alp Dogan, Benjie Wang, Allen Peng, Guy Van den Broeck, Yuchen Cui

机构 * Michigan State University(密歇根州立大学) University of California Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 记忆与上下文管理 :agent(abstract,abstract_cn);分类 cs.AI

AI总结 Meta-Ctrl是一种约束解码框架,通过引入元标记分离句法与语义约束,在保证规划满足约束的同时保留语言模型的规划质量,在WAH-NL数据集和真实桌面机器人上均取得优于GPT-4的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22101 2026-08-25 cs.LG 新提交 70%

Beyond Fresh Starts: Stateful Inference for Streaming ASR in Conversational Voice Agents

超越全新启动:会话语音智能体中流式ASR的有状态推理

Sameep Chattopadhyay, Alexander Erdmann, Mari Ostendorf

机构 * University of Washington(华盛顿大学) SRI International(国际 SRI 研究所)

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.LG

AI总结 针对会话语音智能体流式ASR因每轮重置状态导致的话语起始性能下降问题,提出两种保留跨轮次话语上下文的状态管理策略,在实验中实现15-21%的相对WER降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.22061 2026-08-25 cs.AI cs.CY 新提交 70%

MEMORY Wins All: Indirect Bias Injection Attacks via Social Media Feeds

内存即胜利:通过社交媒体信息流实施的间接偏见注入攻击

Minjae Seo, Wonwoo Choi, Geonwoo Han, Taekyoung Kwon, Yongsu Kim, Sang Seo, Jaewon Noh, Hankyul Baek, Seongyun Seo, Myoungsung You

机构 * ETRI(韩国电子通信研究院) ADD(国防发展局) University of Seoul(首尔大学) Seoul National University(首尔国立大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 该研究提出IBIA间接偏见注入攻击,通过社交媒体信息流植入偏见操纵AI智能体,在BiasBench上对GPT-5.5等模型实现高攻击成功率,还提出内存边界防御降低攻击效果。

Comments 18 pages, 7 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.21439 2026-08-25 cs.CV 新提交 67%

WorldMind: Decoupled Game World Model for State-Aware NPC Behavior

WorldMind:用于状态感知NPC行为的解耦游戏世界模型

Zhiyang Deng, Boran Zhang, Danze Chen, Yeying Jin

机构 * Tencent(腾讯)

专题命中 记忆与上下文管理 :agent(abstract);planning(abstract)

AI总结 本研究针对现有游戏世界模型中NPC行为与视频生成绑定的问题,提出首个解耦框架WorldMind,构建BOSS-140K数据集,实验显示其NPC行为更优。

Comments Project page: https://teawhite.cn/worldmind_projectpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20553 2026-08-25 cs.AI cs.CL 版本更新 62%

CMI-Mem: Toward Generalizable Long-Term Memory Management via CMI-Augmented Reinforcement Learning

CMI-Mem:通过CMI增强的强化学习实现可泛化的长期内存管理

Yubo Wang, Qiuyu Zhao, Zenghui Sun, Shichao Dong, Jinsong Lan, Xiaoyong Zhu, Haoyang Li, Bo Zheng, Lei Chen

机构 * Alibaba Group(阿里巴巴集团) HKUST(香港科技大学) PolyU(香港理工大学) HKUST(GZ)(香港科技大学(广州))

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 研究针对现有内存管理器模型局限,提出基于强化学习的CMI-Mem模型,结合下游问答正确性与内在条件互信息CMI作为混合奖励,可评估新输入信息,补充而非取代问答基础,实现可泛化的长期内存管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03536 2026-08-25 cs.CL cs.AI 版本更新 62%

GraphMed-LT: Patient-Specific Graph Memory with Latent Clinical Thought Refinement for Multi-Turn Medical Conversations

GraphMed-LT:面向多轮医疗对话的具有潜在临床思维优化的患者特定图记忆

Zhaohan Meng, Zaiqiao Meng, Siwei Liu, Hao Xu, Ke Yuan, Iadh Ounis

机构 * School of Computing Science, University of Glasgow, UK(格拉斯哥大学计算机科学学院) School of Natural and Computing Science, University of Aberdeen, UK(阿伯丁大学自然与计算科学学院)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 该研究针对多轮医疗对话中临床证据分散的问题,提出GraphMed-LT方法,通过患者特定图记忆及潜在临床思维优化,在多轮医疗QA任务上较基线实现显著提升。

Comments Accepted to EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏