arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-06 至 2026-02-06 共收录 95 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 16 篇

2405.18521 2026-02-06 econ.TH cs.GT 50%

Learning and Communication Towards Unanimous Consent

学习与沟通以达成一致同意

Yingkai Li, Boli Xu

专题命中 多智能体 :agent(abstract)

AI总结 本文研究了在有限承诺下,委托人如何通过测试和沟通实现代理人一致同意的最优策略,发现阈值测试和区间测试在不同偏好对齐情况下各有优势。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 10 篇

2602.04575 2026-02-06 cs.AI 85%

Vibe AIGC: A New Paradigm for Content Generation via Agentic Orchestration

Vibe AIGC:通过代理编排实现内容生成的新范式

Jiaheng Liu, Yuanxing Zhang, Shihao Li, Xinping Lei

机构 * NJU-LINK Team, Nanjing University(南京大学NJU-LINK团队) Kling Team, Kuaishou Technology(快手科技Kling团队)

专题命中 工作流自动化 :agentic(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 Vibe AIGC通过代理编排实现内容生成,解决意图-执行差距问题,推动人机协作经济变革。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04104 2026-02-06 cs.HC 78%

Making Videos Accessible for Blind and Low Vision Users Using a Multimodal Agent Video Player

通过多模态代理视频播放器使视频对视障和低视力用户更加可访问

Adriana Olmos, Anoop K. Sinha, Renelito Delos Santos, Ruben Rodriguez Rodriguez, James A. Landay, Sam S. Sepah, Philip Nelson, Shaun K. Kane

专题命中 工作流自动化 :agent(title,abstract)

AI总结 本文提出一种多模态代理视频播放器,通过多层提示编排为视障和低视力用户带来交互式、可访问的视频体验,增强用户自主性和信任感。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07838 2026-02-06 cs.DC 78%

A Terminology for Scientific Workflow Systems

科学工作流系统术语

Frédéric Suter, Tainã Coleman, İlkay Altintaş, Rosa M. Badia, Bartosz Balis, Kyle Chard, Iacopo Colonnelli, Ewa Deelman, Paolo Di Tommaso, Thomas Fahringer, Carole Goble, Shantenu Jha, Daniel S. Katz, Johannes Köster, Ulf Leser, Kshitij Mehta, Hilary Oliver, J. -Luc Peterson, Giovanni Pizzi, Loïc Pottier, Raül Sirvent, Eric Suchyta, Douglas Thain, Sean R. Wilkinson, Justin M. Wozniak, Rafael Ferreira da Silva

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 本文提出了一种基于五个轴的WMS术语,用于分类和描述现有科学工作流管理系统。

Journal ref Future Generation Computer Systems 174, 107974 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05922 2026-02-06 cs.RO 50%

From Bench to Flight: Translating Drone Impact Tests into Operational Safety Limits

从实验台到飞行:将无人机碰撞测试转化为操作安全限制

Aziz Mohamed Mili, Louis Catar, Paul Gérard, Ilyass Tabiai, David St-Onge

机构 * Lab INIT Robots, Department of Mechanical Engineering, École de technologie supérieure, Montreal, QC, Canada(Lab INIT Robots,机械工程系,École de technologie supérieure,蒙特利尔,QC,加拿大)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一个端到端的开源工具链,将无人机碰撞测试转化为可部署的安全控制器,通过数据驱动模型和实时执行脚本,实现基于测量碰撞风险的运动限制调整,确保室内MAV操作的安全性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18639 2026-02-06 cs.RO 50%

Constraint-Aware Discrete-Time PID Gain Optimization for Robotic Joint Control Under Actuator Saturation

考虑约束的离散时间PID增益优化用于受执行器饱和影响的机器人关节控制

Ojasva Mishra, Xiaolong Wu, Min Xu

机构 * Downingtown STEM Academy(Downingtown STEM学院) Carnegie Mellon University(卡内基梅隆大学) School of Computer Science(计算机科学学院)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种考虑约束的离散时间PID增益优化方法,通过混合认证的贝叶斯优化工作流程提升机器人关节控制的鲁棒性。

Comments Pending IEEE Transactions on Robotics Publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00713 2026-02-06 stat.AP stat.ME 50%

Using Individualized Treatment Effects to Assess Treatment Effect Heterogeneity

利用个体治疗效应评估治疗效应异质性

Konstantinos Sechidis, Cong Zhang, Sophie Sun, Yao Chen, Asher Spector, Björn Bornkamp

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用个体治疗效应评估治疗效应异质性的方法,结合DR学习器和WATCH工作流程,提供稳健的分析框架以提升临床决策。

Journal ref Statistics in Medicine 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05111 2026-02-06 cs.HC 50%

Metacognitive Demands and Strategies While Using Off-The-Shelf AI Conversational Agents for Health Information

在使用现成的人工智能对话代理获取健康信息时的元认知需求与策略

Shri Harini Ramesh, Foroozan Daneshzand, Babak Rashidi, Shriti Raj, Hariharan Subramonyam, Fateme Rajabiyazdi

专题命中 工作流自动化 :agent(abstract)

AI总结 研究探讨了使用现成AI对话代理获取健康信息时的元认知需求及用户应对策略,并提出设计改进以提升用户体验。

Journal ref In Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23242 2026-02-06 astro-ph.GA astro-ph.IM physics.chem-ph physics.comp-ph 50%

Automated Exploration of Radical-Molecule Chemistry: The Case of Oxirane + CH in the ISM

星际介质中氧环烷与CH自由基反应的自动化探索:氧环烷+CH的案例

Moritz Bensberg, Silvia Alessandrini, Mattia Melosso, Cristina Puzzarini, Markus Reiher

专题命中 工作流自动化 :workflow(abstract)

AI总结 研究通过自动化方法探索氧环烷与CH自由基反应的势能面,以确定主要产物及速率常数,揭示星际介质中产物丰度差异的动力学机制。

Comments 21 pages, 14 figures, 2 tables

Journal ref Astrophys. J. 998 (2026) 104

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01303 2026-02-06 quant-ph 50%

The Dance of the Sheared Eigenfunctions

剪切本征函数的舞蹈

J. Oliveira-Cony, Reinaldo de Melo e Souza, F. S. S. Rosa, C. Farina

专题命中 工作流自动化 :agent(abstract)

AI总结 本文研究了非相对论量子力学中剪切势的理论,分析了剪切过程对本征函数的影响,并探讨了光谱变化与外部工作之间的联系。

Comments Second Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11655 2026-02-06 cs.CV 50%

TextOCVP: Object-Centric Video Prediction with Language Guidance

TextOCVP: 基于语言指导的对象中心视频预测

Angel Villar-Corrales, Gjergj Plepi, Sven Behnke

机构 * University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔人工智能机器学习研究所) Center for Robotics(机器人中心)

专题命中 工作流自动化 :autonomous agent(abstract)

AI总结 TextOCVP通过文本指导的对象中心模型实现更精确可控的视频预测,优于现有基线。

Comments Published at TMLR 02/2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 4 篇

2506.17208 2026-02-06 cs.SE cs.AI cs.CL 85%

Dissecting the SWE-Bench Leaderboards: Profiling Submitters and Architectures of LLM- and Agent-Based Repair Systems

解析SWE-Bench排行榜:LLM和基于代理的修复系统的提交者与架构分析

Matias Martinez, Xavier Franch

专题命中 软件智能体 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 本文分析了SWE-Bench排行榜上的提交者和架构,揭示了专有LLM的主导地位及不同设计类型。

Comments Part of this work (RQ1) has been published at the 2026 IEEE/ACM 48th International Conference on Software Engineering (ICSE-SEIP 2026), DOI: 10.1145/3786583.3786904. The published version is also available on arXiv at arXiv:2602.04449

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13515 2026-02-06 cs.SE cs.CL cs.LO 62%

Fine-tuned LLM-based Code Migration Framework

基于微调的LLM代码迁移框架

Oleg Grynets, Vasyl Lyashkevych, Dmytro Baran, Maksym Orliansky, Taras Zelenyy, Markiian Leshchyshyn

专题命中 软件智能体 :workflow(abstract);分类 cs.CL、cs.SE

AI总结 本研究提出一种基于微调LLM的代码迁移框架,通过自动化SQL特征检测和半监督错误分析,提升数据库迁移的精度与效率。

Comments 16 pages, 27 figures, 7 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05465 2026-02-06 cs.SE 57%

Can We Classify Flaky Tests Using Only Test Code? An LLM-Based Empirical Study

仅通过测试代码可以对不稳定测试进行分类吗?基于LLM的经验研究

Alexander Berndt, Vekil Bekmyradov, Rainer Gemulla, Marcus Kessel, Thomas Bach, Sebastian Baltes

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 本研究探讨了仅通过测试代码是否能有效分类不稳定测试,发现LLM在无额外上下文时表现有限,需进一步结合检索增强生成等方法提升泛化能力。

Comments 10 pages, 3 figures, 7 tables, 33rd IEEE International Conference on Software Analysis, Evolution and Reengineering: Reproducibility Studies and Negative Results (SANER-RENE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05134 2026-02-06 cs.LG cs.DB 57%

SemPipes -- Optimizable Semantic Data Operators for Tabular Machine Learning Pipelines

SemPipes -- 可优化的语义数据运算符用于表格机器学习流水线

Olga Ovcharenko, Matthias Boehm, Sebastian Schelter

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 SemPipes通过LLM驱动的语义数据运算符提升表格机器学习流水线的预测性能和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 6 篇

2602.05429 2026-02-06 cs.AI cs.CV 88%

M$^2$-Miner: Multi-Agent Enhanced MCTS for Mobile GUI Agent Data Mining

M$^2$-Miner: 多智能体增强的MCTS用于移动GUI智能体数据挖掘

Rui Lv, Juncheng Mo, Tianyi Chu, Chen Rao, Hongyi Jing, Jiajie Teng, Jiafu Chen, Shiqi Zhang, Liangzi Ding, Shuo Fang, Huaizhong Lin, Ziqiang Dang, Chenguang Ma, Lei Zhao

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学)

专题命中 GUI与网页智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 M$^2$-Miner通过多智能体增强MCTS方法,实现了低成本、高效率的移动GUI智能体数据挖掘,提升了数据质量和挖掘效果。

Comments Accepted by ICLR 2026. Supplementary material is included at the end of the main paper (16 pages, 15 figures, 2 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12972 2026-02-06 cs.HC cs.SE 74%

TaskAudit: Detecting Functiona11ity Errors in Mobile Apps via Agentic Task Execution

TaskAudit: 通过代理任务执行检测移动应用中的功能性错误

Mingyuan Zhong, Xia Chen, Davin Win Kyi, Chen Li, James Fogarty, Jacob O. Wobbrock

专题命中 GUI与网页智能体 :agentic(title);分类 cs.SE

AI总结 TaskAudit通过代理任务执行检测移动应用中的功能性错误,识别出更多常见的可访问性问题。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10962 2026-02-06 cs.LG cs.AI 62%

WebSTAR: Scalable Data Synthesis for Computer Use Agents with Step-Level Filtering

WebSTAR: 可扩展的数据合成用于计算机使用代理的步级过滤

Yifei He, Pranit Chawla, Yaser Souri, Subhojit Som, Xia Song

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软公司)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI、cs.LG

AI总结 WebSTAR通过步级过滤技术合成高质量数据,构建了WebSTAR和WebSCORE数据集,并训练了高效的过程奖励模型StepRM,提升计算机使用代理的训练效果和部署效率。

Comments Project website: https://yifei-he.github.io/webstar-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05948 2026-02-06 cs.DC cs.DS cs.MA cs.RO 50%

Location-Aware Dispersion on Anonymous Graphs

具有位置意识的匿名图上分散问题

Himani, Supantha Pandit, Gokarna Sharma

机构 * Dhirubhai Ambani University(迪鲁巴希·阿姆巴尼大学) Kent State University(肯特州立大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 本文提出具有位置意识的匿名图分散问题,开发确定性算法并分析其可行性,揭示了与传统分散问题相比的挑战。

Comments 3 tables, 2 figures, 6 pseudo-codes

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05832 2026-02-06 cs.CV 50%

UI-Mem: Self-Evolving Experience Memory for Online Reinforcement Learning in Mobile GUI Agents

UI-Mem: 为移动GUI代理在线强化学习中的自演化经验记忆

Han Xiao, Guozhi Wang, Hao Wang, Shilong Liu, Yuxiang Chai, Yue Pan, Yufeng Zhou, Xiaoxin Chen, Yafei Wen, Hongsheng Li

机构 * Multimedia Laboratory (MMLab), The Chinese University of Hong Kong(香港中文大学多媒体实验室) Shenzhen Loop Area Institute(深圳河套学院) Shanghai AI Lab(上海人工智能实验室) vivo AI Lab(vivo人工智能实验室) Princeton University(普林斯顿大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 UI-Mem通过自演化经验记忆提升移动GUI代理在线强化学习性能,实现跨任务经验转移与策略优化。

Comments 23 pages, 16 figures. Project page: https://ui-mem.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24750 2026-02-06 eess.SP 50%

Opportunistic Screening of Wolff-Parkinson-White Syndrome using Single-Lead AI-ECG Mobile System: A Real-World Study of over 3.5 million ECG Recordings in China

利用单导联AI心电图移动系统对沃波-帕金森-白综合征进行机会性筛查:中国350万份心电图记录的实世界研究

Shun Huang, Deyun Zhang, Sumei Fan, Gongzheng Tang, Shijia Geng, Yujie Xiao, Xingliang Wu, Mingke Yan, Haoyu Wang, Rui Zhang, Zhaoji Fu, Shenda Hong

专题命中 GUI与网页智能体 :workflow(abstract)

AI总结 本研究利用单导联AI心电图移动系统对中国350万份心电图记录进行机会性筛查,通过人机协作显著提高了沃波-帕金森-白综合征的筛查效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 记忆与上下文管理 6 篇

2602.05524 2026-02-06 cs.MA cs.AI 88%

AI Agent Systems for Supply Chains: Structured Decision Prompts and Memory Retrieval

供应链中的AI代理系统:结构化决策提示与记忆检索

Konosuke Yoshizato, Kazuma Shimizu, Ryota Higa, Takanobu Otsuka

机构 * National Institute of Advanced Industrial Science and Technology(国家先进工业科学与技术研究院) Nagoya Institute of Technology(名古屋技术大学) NEC Corporation(日本电讯公司)

专题命中 记忆与上下文管理 :agent(title,abstract);AI agent(title);multi-agent(abstract);分类 cs.AI

AI总结 本文提出AIM-RM代理,通过相似性匹配提升基于LLM的多代理系统在供应链中的适应性和鲁棒性。

Comments A full version of the extended abstract accepted by the 25th International Conference on Autonomous Agents and Multiagent Systems(AAMAS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05762 2026-02-06 cs.AI cs.LG cs.LO cs.SE 80%

RocqSmith: Can Automatic Optimization Forge Better Proof Agents?

RocqSmith: 自动优化能否打造更优的证明代理?

Andrei Kozyrev, Nikita Khramov, Denis Lochmelis, Valerio Morelli, Gleb Solovev, Anton Podkopaev

机构 * JetBrains Research Germany(JetBrains德国研究机构) JetBrains Research Netherlands(JetBrains荷兰研究机构) Constructor University Bremen(布雷梅Constructor大学)

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 RocqSmith研究自动优化方法在提升证明代理性能上的效果,发现简单引导方法效果最佳,但无法超越精心设计的证明代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05665 2026-02-06 cs.AI 79%

Graph-based Agent Memory: Taxonomy, Techniques, and Applications

基于图的智能体记忆:分类、技术与应用

Chang Yang, Chuang Zhou, Yilin Xiao, Su Dong, Luyao Zhuang, Yujing Zhang, Zhu Wang, Zijin Hong, Zheng Yuan, Zhishang Xiang, Shengyuan Chen, Huachi Zhou, Qinggang Zhang, Ninghao Liu, Jinsong Su, Xinrun Wang, Yi Chang, Xiao Huang

机构 * The Hong Kong Polytechnic University(香港理工大学) School of Information(信息学院) Xiamen University(厦门大学) School of Computing and Information Systems(计算与信息学院) Singapore Management University(新加坡国立管理学院) School of Artificial Intelligence(人工智能学院)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.AI

AI总结 本文系统综述了基于图的智能体记忆,涵盖分类、关键技术、应用及挑战,旨在推动更高效可靠的图基智能体记忆系统发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05854 2026-02-06 cs.HC 75%

DuoDrama: Supporting Screenplay Refinement Through LLM-Assisted Human Reflection

DuoDrama: 通过LLM辅助的人类反思支持剧本润色

Yuying Tang, Xinyi Chen, Haotian Li, Xing Xie, Xiaojuan Ma, Huamin Qu

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);workflow(abstract)

AI总结 DuoDrama通过LLM辅助人类反思,提升剧本润色阶段的反馈质量和反思深度。

Comments Accepted by CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02594 2026-02-06 cs.LG cs.AI cs.SE 67%

SMARLA: A Safety Monitoring Approach for Deep Reinforcement Learning Agents

SMARLA:一种用于深度强化学习智能体的安全监控方法

Amirhossein Zolfagharian, Manel Abdellatif, Lionel C. Briand, Ramesh S

机构 * School of Electrical Engineering and Computer Science (EECS), University of Ottawa(电气工程与计算机科学系,渥太华大学) Software and Information Technology Engineering Department, École de Technologie Supérieure(软件与信息技术工程系,高等技术学院) Lero SFI Research Center and University of Limerick(Lero SFI研究中心和利默里克大学) Department of Research and Development, General Motors(研发部,通用汽车)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 SMARLA是一种用于深度强化学习智能体的安全监控方法,通过状态抽象和Q值预测安全违规,实现早期检测与低假阳性率的平衡。

Journal ref in IEEE Transactions on Software Engineering, vol. 51, no. 01, pp. 82-105, Jan. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05017 2026-02-06 cs.DC q-bio.CB 50%

A novel scalable high performance diffusion solver for multiscale cell simulations

一种新型可扩展高性能扩散求解器用于多尺度细胞模拟

Jose-Luis Estragues-Muñoz, Carlos Alvarez, Arnau Montagud, Daniel Jimenez-Gonzalez, Alfonso Valencia

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于高效有限体积法的高性能计算求解器,用于多尺度细胞模拟,实现了200倍的加速和36%的内存节省。

Comments 14 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. Agent评测 8 篇

2602.05662 2026-02-06 cs.HC 82%

Making AI Agents Evaluate Misleading Charts without Nudging

让AI代理在不引导的情况下评估误导性图表

Swaroop Panda

专题命中 Agent评测 :AI agent(title,abstract);agent(abstract)

AI总结 本文研究了AI代理在未被引导的情况下评估误导性图表的能力,发现其在图形完整性受损时仍能保持较高的审美和可读性评分,表明需明确引导才能有效识别完整性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05105 2026-02-06 cs.AI cs.RO cs.SE 79%

GAMMS: Graph based Adversarial Multiagent Modeling Simulator

基于图的对抗多智能体建模模拟器

Rohan Patil, Jai Malegaonkar, Xiao Jiang, Andre Dion, Gaurav S. Sukhatme, Henrik I. Christensen

机构 * University of Southern California(美国南加州大学)

专题命中 Agent评测 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.SE

AI总结 GAMMS是一款轻量级多智能体仿真框架,支持图结构环境下的快速开发与评估,提供可视化反馈和现实基础,适用于复杂领域如交通和通信系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05671 2026-02-06 cs.HC 78%

(Computer) Vision in Action: Comparing Remote Sighted Assistance and a Multimodal Voice Agent in Inspection Sequences

行动中的视觉:比较远程视觉援助与多模态语音代理在检查序列中的表现

Damien Rudaz, Barbara Nino Carreras, Sara Merlino, Brian L. Due, Barry Brown

专题命中 Agent评测 :agent(title,abstract)

AI总结 研究比较了远程视觉援助与多模态语音代理在检查任务中的表现,发现代理无法产生基于环境的视觉动作,从而缺乏关键资源。

Comments Conditionally accepted at CHI 2026, 32 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏