Real-Time BDI Agents: a model and its implementation
实时BDI代理:一种模型及其实现
专题命中 工作流自动化 :agent(abstract);分类 cs.SE
AI总结 本文提出了一种改进的实时BDI代理模型,通过引入时间管理机制,提升代理在实时环境中的反应能力和应用效果。
Comments 13 pages
AI 大模型
智能体、工具调用、规划、工作流、多智能体和自主任务执行。
实时BDI代理:一种模型及其实现
专题命中 工作流自动化 :agent(abstract);分类 cs.SE
AI总结 本文提出了一种改进的实时BDI代理模型,通过引入时间管理机制,提升代理在实时环境中的反应能力和应用效果。
Comments 13 pages
对齐的计算复杂性
专题命中 工作流自动化 :workflow(abstract)
AI总结 研究了对齐问题在不同Petri网类别的计算复杂性,证明其在安全Petri网和流程网中为PSPACE完全,在活有界系统中为NP完全,并在某些子类中为NP完全。
Comments 46 pages, 5 figures, submitted to Fundamenta Informaticae
重新思考协作机器人在康复中的作用
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文探讨协作机器人在康复治疗中的多方面作用,包括协助治疗师和患者,提升治疗可及性,并提出未来研究方向。
Comments 5 pages, 1 figure
利用ASCA对时间序列中的循环平稳性进行建模
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出利用ASCA方法对时间序列中的循环平稳性进行建模,通过分析水温趋势和花粉数据验证其有效性,提升多变量数据的可解释性与推断能力。
Comments 27 pages and 4 figures in main text. 16 pages and 8 figures in supplementary materials
Roomify:基于空间的风格转换用于沉浸式虚拟环境
专题命中 工作流自动化 :workflow(abstract)
AI总结 Roomify通过结合3D场景理解、AI推理和风格生成,实现基于用户实际空间的沉浸式虚拟环境转换,提升沉浸感和创意表达性。
Comments Accepted at CHI 2026 (ACM Conference on Human Factors in Computing Systems). 24 pages, 10 figures. Author's version
迈向预测量子算法性能:大规模时间相关噪声建模
专题命中 工作流自动化 :workflow(abstract)
AI总结 本文提出通过张量网络与量子自回归移动平均模型结合,量化时间相关噪声对量子算法性能的影响,并提出预测基准测试协议以提升大规模模拟的准确性。
Comments 13 pages, 4 figures, 1 table
ExposureEngine:面向体育转播的定向logo检测与赞助商可见性分析
机构 * Forzasys ; SimulaMet ; Oslo Metropolitan University(奥斯陆 Metropolitan 大学) ; UiT
专题命中 工作流自动化 :agentic(abstract)
AI总结 ExposureEngine通过端到端系统实现体育转播中旋转感知的赞助商可见性分析,采用OBB预测提升定位精度,并结合自然语言处理生成报告。
Comments This work has been submitted to the IEEE for possible publication
EVMbench:在智能合约安全上评估AI代理
机构 * OpenAI ; Paradigm ; OtterSec
专题命中 软件智能体 :AI agent(title,abstract);分类 cs.AI、cs.LG
AI总结 EVMbench通过评估AI代理在智能合约安全领域的检测、修补和利用能力,揭示了AI在区块链安全评估中的潜力与挑战。
自我归因偏差:当AI监控对自己宽容时
专题命中 软件智能体 :tool-use(abstract);agentic(abstract);分类 cs.AI、cs.LG
AI总结 研究发现AI监控在自我归因偏差下可能低估风险,导致部署不充分的监控系统。
LLM裁判可靠性检测工具:检验LLM裁判的可靠性
机构 * RAND Corporation(RAND公司)
专题命中 软件智能体 :agentic(abstract);分类 cs.AI
AI总结 本研究提出了一种开源工具,用于评估LLM裁判在不同基准中的可靠性,发现模型和扰动类型对性能有显著影响。
Comments Accepted at Agents in the Wild: Safety, Security, and Beyond Workshop at ICLR 2026 - April 26, 2026, Rio de Janeiro, Brazil
迈向自编码信息系统的构建
专题命中 软件智能体 :agentic(abstract);分类 cs.SE
AI总结 本文提出自编码信息系统,旨在通过自动生成和部署源代码来提升系统动态适应能力,缩短新功能的上市时间。
Comments Accepted for ICSE 2026 Track "Software Architecture BoF"
AegisUI:用于AI代理系统中结构化用户界面协议行为异常检测
机构 * Department of Computer Science(计算机科学系) ; Department of Information Technology(信息技术系) ; Muffakham Jah College of Engineering(穆法卡姆·贾赫工程学院)
专题命中 GUI与网页智能体 :AI agent(title,abstract);agent(title,comments);workflow(abstract);分类 cs.AI
AI总结 AegisUI通过生成结构化UI载荷并检测行为异常,提升AI代理系统中用户界面的安全性。
Comments 8 pages, 7 figures, 5 tables. Behavioral anomaly detection framework for security analysis of AI agent-generated UI protocol payloads
GhostEI-Bench: 移动代理在动态设备环境中的环境注入鲁棒性研究
机构 * Shanghai Jiao Tong University, School of Computer Science(上海交通大学计算机科学学院) ; Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; The University of Hong Kong(香港大学)
专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);分类 cs.AI
AI总结 GhostEI-Bench通过动态环境注入攻击评估移动代理的鲁棒性,揭示现有模型对欺骗性UI的脆弱性,并提供量化和缓解该威胁的框架。
重放预训练数据提高微调
机构 * Stanford University(斯坦福大学)
专题命中 GUI与网页智能体 :agentic(abstract);分类 cs.CL、cs.LG
AI总结 通过重放预训练数据提升微调效果,提高目标任务性能
在边缘硬件上实现四足机器人在地下矿井中高效自主导航
机构 * Department of Mining and Explosive Engineering, Missouri University of Science and Technology(采矿与爆炸工程系,密苏里科技大学)
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本研究提出了一种在边缘硬件上运行的四足机器人自主导航系统,无需GPU和网络连接,实现了在地下矿井中高效、可靠的自主导航。
侦察-轮式机器人合作:行星类比探索中的在线地形强度映射与通行风险估计
专题命中 GUI与网页智能体 :planning(abstract)
AI总结 本文提出了一种scout-rover合作框架,通过腿式和轮式机器人联合实现行星类比探索中的地形强度在线映射和通行风险估计,提升科学探索的鲁棒性和可达性。
Comments 8 figures
代理记忆低于提示:持久化Q4 KV缓存用于边缘设备上的多代理LLM推理
专题命中 记忆与上下文管理 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI、cs.LG
AI总结 本文提出了一种持久化Q4 KV缓存的方法,用于在边缘设备上提高多代理LLM推理效率,通过减少缓存恢复时间,提升模型性能。
Comments 24 pages, 6 figures, 16 tables. Open-source implementation at https://github.com/yshk-mxim/agent-memory
EchoGuard: 一种基于知识图谱记忆的代理框架,用于检测纵向对话中的操纵性沟通
专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 EchoGuard通过知识图谱记忆和结构化循环检测纵向对话中的操纵性沟通,提升个体识别能力与自主性。
迈向多模态终身理解:一个数据集和代理基准
专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract)
AI总结 本文提出MM-Lifelong数据集和ReMA代理,解决多模态终身理解中的工作记忆瓶颈和全局定位崩溃问题,通过动态内存管理提升模型性能。
AMV-L:用于长运行LLM系统中尾延迟控制的生命周期管理代理内存
专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG
AI总结 AMV-L通过生命周期管理内存,有效降低LLM长运行系统的延迟和吞吐量,提升极端尾部性能。
记忆作为本体:一种持久数字公民的宪法记忆架构
专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI
AI总结 本文提出记忆作为本体的范式,设计了Animesis系统,针对持久数字公民的生命周期问题,强调身份连续性而非检索性能。
Comments 22 pages, 5 figures, 2 tables, including terminology glossary
从词到世界:大型语言模型能否作为隐式的基于文本的世界模型?
机构 * Southern University of Science and Technology(南方科技大学) ; Microsoft Research(微软研究院) ; University of Edinburgh(爱丁堡大学) ; Princeton University(普林斯顿大学) ; Oxford University(牛津大学) ; University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校) ; Fudan University(复旦大学) ; Mind Lab
专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.CL
AI总结 本文研究了大型语言模型在基于文本的环境中作为世界模型的可行性,通过三个评估层面验证了其在提升智能体性能方面的有效性,并明确了环境复杂性和行为覆盖对世界建模效果的影响。
INMS: 基于大语言模型的智能体中的记忆共享
机构 * Rutgers University(罗格斯大学)
专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.CL
AI总结 INMS通过异步交互范式实现多智能体间的动态记忆共享,提升开放性场景下的智能体性能。
自适应记忆准入控制用于大语言模型代理
机构 * Workday AI
专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL
AI总结 提出自适应记忆准入控制框架,通过分解记忆价值因素提升大语言模型代理的长期记忆管理效率与可靠性。
僵尸代理:通过自我强化注入实现自我演化大语言模型代理的持续控制
机构 * School of Computing National University of Singapore(计算学院新加坡国立大学)
专题命中 记忆与上下文管理 :agent(abstract,comments);分类 cs.AI
AI总结 研究提出僵尸代理攻击,通过自我强化注入实现对自我演化大语言模型代理的持续控制,揭示内存演化可将一次间接注入转化为持久妥协,表明单一会话提示过滤防御不足。
Comments Published as a workshop paper in Lifelong Agent @ ICLR 2026
AutoSkill: 通过技能自我进化实现经验驱动的终身学习
机构 * School of Computer Science and Technology, East China Normal University(1 计算机科学与技术学院,东华大学) ; Shanghai AI Laboratory(2 上海人工智能实验室)
专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI
AI总结 AutoSkill通过技能自我进化实现经验驱动的终身学习,使LLM代理能够自动推导、维护和重用技能,提升个性化能力的持续性和可重用性。
环形意见空间对意见双极化的影响
专题命中 记忆与上下文管理 :agent(abstract)
AI总结 本文研究了环形意见空间对意见双极化的影响,发现其在稳态下能形成更多群体,并对扩展更敏感。
Comments 15 pages + Appendices. Comments welcome
FinRetrieval:通过AI代理进行金融数据检索的基准测试
专题命中 Agent评测 :AI agent(title,abstract);agent(abstract);分类 cs.AI、cs.CL
AI总结 FinRetrieval通过AI代理进行金融数据检索的基准测试,揭示了工具可用性对性能的主导作用及不同代理在推理模式和基础能力上的差异。
Comments 26 pages, 2 figures, 16 tables
AgentSCOPE: 在代理工作流中评估上下文隐私
机构 * University of Vermont(佛蒙特大学) ; IBM Research(IBM研究院)
专题命中 Agent评测 :agentic(title,abstract);agent(abstract);分类 cs.AI
AI总结 AgentSCOPE通过评估代理工作流中的隐私流,揭示了中间阶段的隐私风险,指出输出层面评估不足以反映代理系统的隐私问题。
通过复杂度提升强化学习实现奥lympia级几何大语言模型代理
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Shanghai Jiao Tong University(上海交通大学) ; Peking University(北京大学) ; ICMAT Spanish National Research Council(西班牙国家研究委员会ICMAT) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 Agent评测 :agent(title,abstract);分类 cs.AI
AI总结 InternGeometry通过复杂度提升强化学习实现几何问题求解,仅用13K训练示例解决44个IMO问题,超越平均金牌得主得分。