arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-06 至 2026-03-06 共收录 138 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 17 篇

2205.00979 2026-03-06 cs.MA cs.SE 57%

Real-Time BDI Agents: a model and its implementation

实时BDI代理:一种模型及其实现

Andrea Traldi, Francesco Bruschetti, Marco Robol, Davide Calvaresi, Marco Roveri, Paolo Giorgini

专题命中 工作流自动化 :agent(abstract);分类 cs.SE

AI总结 本文提出了一种改进的实时BDI代理模型,通过引入时间管理机制,提升代理在实时环境中的反应能力和应用效果。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05331 2026-03-06 cs.FL 50%

Computational Complexity of Alignments

对齐的计算复杂性

Christopher T. Schwanen, Wied Pakusa, Wil M. P. van der Aalst

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究了对齐问题在不同Petri网类别的计算复杂性,证明其在安全Petri网和流程网中为PSPACE完全,在活有界系统中为NP完全,并在某些子类中为NP完全。

Comments 46 pages, 5 figures, submitted to Fundamenta Informaticae

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05252 2026-03-06 cs.RO 50%

Rethinking the Role of Collaborative Robots in Rehabilitation

重新思考协作机器人在康复中的作用

Vivek Gupte, Shalutha Rajapakshe, Emmanuel Senft

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文探讨协作机器人在康复治疗中的多方面作用,包括协助治疗师和患者,提升治疗可及性,并提出未来研究方向。

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05065 2026-03-06 stat.ME 50%

Modeling cyclostationarity in time series using ASCA

利用ASCA对时间序列中的循环平稳性进行建模

Daniel Vallejo-España, Jesús García Sánchez, Manuel Villar-Argaiz, Concepción De Linares, José Camacho

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用ASCA方法对时间序列中的循环平稳性进行建模,通过分析水温趋势和花粉数据验证其有效性,提升多变量数据的可解释性与推断能力。

Comments 27 pages and 4 figures in main text. 16 pages and 8 figures in supplementary materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04917 2026-03-06 cs.HC 50%

Roomify: Spatially-Grounded Style Transformation for Immersive Virtual Environments

Roomify:基于空间的风格转换用于沉浸式虚拟环境

Xueyang Wang, Qinxuan Cen, Weitao Bi, Yunxiang Ma, Xin Yi, Robert Xiao, Xinyi Fu, Hewu Li

专题命中 工作流自动化 :workflow(abstract)

AI总结 Roomify通过结合3D场景理解、AI推理和风格生成,实现基于用户实际空间的沉浸式虚拟环境转换,提升沉浸感和创意表达性。

Comments Accepted at CHI 2026 (ACM Conference on Human Factors in Computing Systems). 24 pages, 10 figures. Author's version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04524 2026-03-06 quant-ph 50%

Towards Predictive Quantum Algorithmic Performance: Modeling Time-Correlated Noise at Scale

迈向预测量子算法性能:大规模时间相关噪声建模

Amit Jamadagni, Gregory Quiroz, Eugene Dumitrescu

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出通过张量网络与量子自回归移动平均模型结合,量化时间相关噪声对量子算法性能的影响,并提出预测基准测试协议以提升大规模模拟的准确性。

Comments 13 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04739 2026-03-06 cs.CV cs.MM 50%

ExposureEngine: Oriented Logo Detection and Sponsor Visibility Analytics in Sports Broadcasts

ExposureEngine:面向体育转播的定向logo检测与赞助商可见性分析

Mehdi Houshmand Sarkhoosh, Frøy Øye, Henrik Nestor Sørlie, Nam Hoang Vu, Dag Johansen, Cise Midoglu, Tomas Kupka, Pål Halvorsen

机构 * Forzasys SimulaMet Oslo Metropolitan University(奥斯陆 Metropolitan 大学) UiT

专题命中 工作流自动化 :agentic(abstract)

AI总结 ExposureEngine通过端到端系统实现体育转播中旋转感知的赞助商可见性分析,采用OBB预测提升定位精度,并结合自然语言处理生成报告。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 4 篇

2603.04915 2026-03-06 cs.LG cs.AI cs.CR 81%

EVMbench: Evaluating AI Agents on Smart Contract Security

EVMbench:在智能合约安全上评估AI代理

Justin Wang, Andreas Bigger, Xiaohai Xu, Justin W. Lin, Andy Applebaum, Tejal Patwardhan, Alpin Yukseloglu, Olivia Watkins

机构 * OpenAI Paradigm OtterSec

专题命中 软件智能体 :AI agent(title,abstract);分类 cs.AI、cs.LG

AI总结 EVMbench通过评估AI代理在智能合约安全领域的检测、修补和利用能力,揭示了AI在区块链安全评估中的潜力与挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04582 2026-03-06 cs.AI cs.LG 73%

Self-Attribution Bias: When AI Monitors Go Easy on Themselves

自我归因偏差:当AI监控对自己宽容时

Dipika Khullar, Jack Hopkins, Rowan Wang, Fabien Roger

专题命中 软件智能体 :tool-use(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现AI监控在自我归因偏差下可能低估风险,导致部署不充分的监控系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05399 2026-03-06 cs.AI 57%

Judge Reliability Harness: Stress Testing the Reliability of LLM Judges

LLM裁判可靠性检测工具:检验LLM裁判的可靠性

Sunishchal Dev, Andrew Sloan, Joshua Kavner, Nicholas Kong, Morgan Sandler

机构 * RAND Corporation(RAND公司)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 本研究提出了一种开源工具,用于评估LLM裁判在不同基准中的可靠性,发现模型和扰动类型对性能有显著影响。

Comments Accepted at Agents in the Wild: Safety, Security, and Beyond Workshop at ICLR 2026 - April 26, 2026, Rio de Janeiro, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14132 2026-03-06 cs.SE 57%

Toward architecting self-coding information systems

迈向自编码信息系统的构建

Rodrigo Falcão, Frank Elberzhager, Karthik Vaidhyanathan

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本文提出自编码信息系统,旨在通过自动生成和部署源代码来提升系统动态适应能力,缩短新功能的上市时间。

Comments Accepted for ICSE 2026 Track "Software Architecture BoF"

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 5 篇

2603.05031 2026-03-06 cs.AI 89%

AegisUI: Behavioral Anomaly Detection for Structured User Interface Protocols in AI Agent Systems

AegisUI:用于AI代理系统中结构化用户界面协议行为异常检测

Mohd Safwan Uddin, Saba Hajira

机构 * Department of Computer Science(计算机科学系) Department of Information Technology(信息技术系) Muffakham Jah College of Engineering(穆法卡姆·贾赫工程学院)

专题命中 GUI与网页智能体 :AI agent(title,abstract);agent(title,comments);workflow(abstract);分类 cs.AI

AI总结 AegisUI通过生成结构化UI载荷并检测行为异常,提升AI代理系统中用户界面的安全性。

Comments 8 pages, 7 figures, 5 tables. Behavioral anomaly detection framework for security analysis of AI agent-generated UI protocol payloads

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20333 2026-03-06 cs.CR cs.AI 70%

GhostEI-Bench: Do Mobile Agents Resilience to Environmental Injection in Dynamic On-Device Environments?

GhostEI-Bench: 移动代理在动态设备环境中的环境注入鲁棒性研究

Chiyu Chen, Xinhao Song, Yunkai Chai, Yang Yao, Haodong Zhao, Lijun Li, Jie Li, Yan Teng, Gongshen Liu, Yingchun Wang

机构 * Shanghai Jiao Tong University, School of Computer Science(上海交通大学计算机科学学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学)

专题命中 GUI与网页智能体 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 GhostEI-Bench通过动态环境注入攻击评估移动代理的鲁棒性,揭示现有模型对欺骗性UI的脆弱性,并提供量化和缓解该威胁的框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04964 2026-03-06 cs.CL cs.LG 62%

Replaying pre-training data improves fine-tuning

重放预训练数据提高微调

Suhas Kotha, Percy Liang

机构 * Stanford University(斯坦福大学)

专题命中 GUI与网页智能体 :agentic(abstract);分类 cs.CL、cs.LG

AI总结 通过重放预训练数据提升微调效果,提高目标任务性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04470 2026-03-06 cs.RO 50%

Efficient Autonomous Navigation of a Quadruped Robot in Underground Mines on Edge Hardware

在边缘硬件上实现四足机器人在地下矿井中高效自主导航

Yixiang Gao, Kwame Awuah-Offei

机构 * Department of Mining and Explosive Engineering, Missouri University of Science and Technology(采矿与爆炸工程系,密苏里科技大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本研究提出了一种在边缘硬件上运行的四足机器人自主导航系统,无需GPU和网络连接,实现了在地下矿井中高效、可靠的自主导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18688 2026-03-06 cs.RO 50%

Scout-Rover cooperation: online terrain strength mapping and traversal risk estimation for planetary-analog explorations

侦察-轮式机器人合作:行星类比探索中的在线地形强度映射与通行风险估计

Shipeng Liu, J. Diego Caporale, Yifeng Zhang, Xingjue Liao, William Hoganson, Wilson Hu, Shivangi Misra, Neha Peddinti, Rachel Holladay, Ethan Fulcher, Akshay Ram Panyam, Andrik Puentes, Jordan M. Bretzfelder, Michael Zanetti, Uland Wong, Daniel E. Koditschek, Mark Yim, Douglas Jerolmack, Cynthia Sung, Feifei Qian

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出了一种scout-rover合作框架,通过腿式和轮式机器人联合实现行星类比探索中的地形强度在线映射和通行风险估计,提升科学探索的鲁棒性和可达性。

Comments 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 11 篇

2603.04428 2026-03-06 cs.LG cs.AI 90%

Agent Memory Below the Prompt: Persistent Q4 KV Cache for Multi-Agent LLM Inference on Edge Devices

代理记忆低于提示:持久化Q4 KV缓存用于边缘设备上的多代理LLM推理

Yakov Pyotr Shkolnikov

专题命中 记忆与上下文管理 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种持久化Q4 KV缓存的方法,用于在边缘设备上提高多代理LLM推理效率,通过减少缓存恢复时间,提升模型性能。

Comments 24 pages, 6 figures, 16 tables. Open-source implementation at https://github.com/yshk-mxim/agent-memory

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04815 2026-03-06 cs.AI 83%

EchoGuard: An Agentic Framework with Knowledge-Graph Memory for Detecting Manipulative Communication in Longitudinal Dialogue

EchoGuard: 一种基于知识图谱记忆的代理框架,用于检测纵向对话中的操纵性沟通

Ratna Kandala, Niva Manchanda, Akshata Kishore Moharir, Ananth Kandala

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 EchoGuard通过知识图谱记忆和结构化循环检测纵向对话中的操纵性沟通,提升个体识别能力与自主性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05484 2026-03-06 cs.CV 82%

Towards Multimodal Lifelong Understanding: A Dataset and Agentic Baseline

迈向多模态终身理解:一个数据集和代理基准

Guo Chen, Lidong Lu, Yicheng Liu, Liangrui Dong, Lidong Zou, Jixin Lv, Zhenquan Li, Xinyi Mao, Baoqi Pei, Shihao Wang, Zhiqi Li, Karan Sapra, Fuxiao Liu, Yin-Dong Zheng, Yifei Huang, Limin Wang, Zhiding Yu, Andrew Tao, Guilin Liu, Tong Lu

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract)

AI总结 本文提出MM-Lifelong数据集和ReMA代理,解决多模态终身理解中的工作记忆瓶颈和全局定位崩溃问题,通过动态内存管理提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04443 2026-03-06 cs.DC cs.AI cs.LG cs.SY eess.SY 81%

AMV-L: Lifecycle-Managed Agent Memory for Tail-Latency Control in Long-Running LLM Systems

AMV-L:用于长运行LLM系统中尾延迟控制的生命周期管理代理内存

Emmanuel Bamidele

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 AMV-L通过生命周期管理内存,有效降低LLM长运行系统的延迟和吞吐量,提升极端尾部性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04740 2026-03-06 cs.AI cs.MA 70%

Memory as Ontology: A Constitutional Memory Architecture for Persistent Digital Citizens

记忆作为本体:一种持久数字公民的宪法记忆架构

Zhenghui Li

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出记忆作为本体的范式,设计了Animesis系统,针对持久数字公民的生命周期问题,强调身份连续性而非检索性能。

Comments 22 pages, 5 figures, 2 tables, including terminology glossary

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18832 2026-03-06 cs.CL 70%

From Word to World: Can Large Language Models be Implicit Text-based World Models?

从词到世界:大型语言模型能否作为隐式的基于文本的世界模型?

Yixia Li, Hongru Wang, Jiahao Qiu, Zhenfei Yin, Dongdong Zhang, Cheng Qian, Zeping Li, Pony Ma, Guanhua Chen, Heng Ji

机构 * Southern University of Science and Technology(南方科技大学) Microsoft Research(微软研究院) University of Edinburgh(爱丁堡大学) Princeton University(普林斯顿大学) Oxford University(牛津大学) University of Illinois Urbana-Champaign(伊利诺伊大学香槟分校) Fudan University(复旦大学) Mind Lab

专题命中 记忆与上下文管理 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在基于文本的环境中作为世界模型的可行性,通过三个评估层面验证了其在提升智能体性能方面的有效性,并明确了环境复杂性和行为覆盖对世界建模效果的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09982 2026-03-06 cs.CL 70%

INMS: Memory Sharing for Large Language Model based Agents

INMS: 基于大语言模型的智能体中的记忆共享

Hang Gao, Yongfeng Zhang

机构 * Rutgers University(罗格斯大学)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.CL

AI总结 INMS通过异步交互范式实现多智能体间的动态记忆共享,提升开放性场景下的智能体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04549 2026-03-06 cs.AI cs.CL cs.MA 62%

Adaptive Memory Admission Control for LLM Agents

自适应记忆准入控制用于大语言模型代理

Guilin Zhang, Wei Jiang, Xiejiashan Wang, Aisha Behr, Kai Zhao, Jeffrey Friedman, Xu Chu, Amine Anoun

机构 * Workday AI

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出自适应记忆准入控制框架,通过分解记忆价值因素提升大语言模型代理的长期记忆管理效率与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15654 2026-03-06 cs.CR cs.AI 61%

Zombie Agents: Persistent Control of Self-Evolving LLM Agents via Self-Reinforcing Injections

僵尸代理:通过自我强化注入实现自我演化大语言模型代理的持续控制

Xianglin Yang, Yufei He, Shuo Ji, Bryan Hooi, Jin Song Dong

机构 * School of Computing National University of Singapore(计算学院新加坡国立大学)

专题命中 记忆与上下文管理 :agent(abstract,comments);分类 cs.AI

AI总结 研究提出僵尸代理攻击,通过自我强化注入实现对自我演化大语言模型代理的持续控制,揭示内存演化可将一次间接注入转化为持久妥协,表明单一会话提示过滤防御不足。

Comments Published as a workshop paper in Lifelong Agent @ ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01145 2026-03-06 cs.AI 57%

AutoSkill: Experience-Driven Lifelong Learning via Skill Self-Evolution

AutoSkill: 通过技能自我进化实现经验驱动的终身学习

Yutao Yang, Junsong Li, Qianjun Pan, Bihao Zhan, Yuxuan Cai, Lin Du, Jie Zhou, Kai Chen, Qin Chen, Xin Li, Bo Zhang, Liang He

机构 * School of Computer Science and Technology, East China Normal University(1 计算机科学与技术学院,东华大学) Shanghai AI Laboratory(2 上海人工智能实验室)

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI

AI总结 AutoSkill通过技能自我进化实现经验驱动的终身学习,使LLM代理能够自动推导、维护和重用技能,提升个性化能力的持续性和可重用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05337 2026-03-06 physics.soc-ph cs.MA 50%

The effect of a toroidal opinion space on opinion bi-polarisation

环形意见空间对意见双极化的影响

Frank P. Pijpers, Benedikt V. Meylahn, Michel R. H. Mandjes

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了环形意见空间对意见双极化的影响,发现其在稳态下能形成更多群体,并对扩展更敏感。

Comments 15 pages + Appendices. Comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 21 篇

2603.04403 2026-03-06 cs.IR cs.AI cs.CL 84%

FinRetrieval: A Benchmark for Financial Data Retrieval by AI Agents

FinRetrieval:通过AI代理进行金融数据检索的基准测试

Eric Y. Kim, Jie Huang

专题命中 Agent评测 :AI agent(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 FinRetrieval通过AI代理进行金融数据检索的基准测试,揭示了工具可用性对性能的主导作用及不同代理在推理模式和基础能力上的差异。

Comments 26 pages, 2 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04902 2026-03-06 cs.CR cs.AI 83%

AgentSCOPE: Evaluating Contextual Privacy Across Agentic Workflows

AgentSCOPE: 在代理工作流中评估上下文隐私

Ivoline C. Ngong, Keerthiram Murugesan, Swanand Kadhe, Justin D. Weisz, Amit Dhurandhar, Karthikeyan Natesan Ramamurthy

机构 * University of Vermont(佛蒙特大学) IBM Research(IBM研究院)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 AgentSCOPE通过评估代理工作流中的隐私流,揭示了中间阶段的隐私风险,指出输出层面评估不足以反映代理系统的隐私问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10534 2026-03-06 cs.AI 79%

Achieving Olympia-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning

通过复杂度提升强化学习实现奥lympia级几何大语言模型代理

Haiteng Zhao, Junhao Shen, Yiming Zhang, Songyang Gao, Kuikun Liu, Tianyou Ma, Fan Zheng, Dahua Lin, Wenwei Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) ICMAT Spanish National Research Council(西班牙国家研究委员会ICMAT) The Chinese University of Hong Kong(香港中文大学)

专题命中 Agent评测 :agent(title,abstract);分类 cs.AI

AI总结 InternGeometry通过复杂度提升强化学习实现几何问题求解,仅用13K训练示例解决44个IMO问题,超越平均金牌得主得分。

详情

展开后加载摘要…

URL PDF HTML 收藏