arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-02-09 至 2026-02-09 共收录 96 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 11 篇

2602.06369 2026-02-09 cs.CV cs.AI 57%

Revisiting Salient Object Detection from an Observer-Centric Perspective

重新审视以观察者为中心的显著物体检测

Fuxi Zhang, Yifan Wang, Hengrun Zhao, Zhuohan Sun, Changxing Xia, Lijun Wang, Huchuan Lu, Yangrui Shao, Chen Yang, Long Teng

机构 * Dalian University of Technology(大连理工大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 本文提出OC-SOD方法,通过考虑观察者偏好和意图,实现个性化显著性预测,并构建首个OC-SOD数据集和代理基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13486 2026-02-09 cs.CV cs.CL cs.GR 57%

T$^3$-S2S: Training-free Triplet Tuning for Sketch to Scene Synthesis in Controllable Concept Art Generation

T$^3$-S2S:无训练三元组微调用于可控概念艺术生成中的草图到场景合成

Zhenhong Sun, Yifu Wang, Yonhon Ng, Yongzhi Xu, Daoyi Dong, Hongdong Li, Pan Ji

机构 * Australian National University(澳大利亚国立大学) Vertex Lab(Vertex实验室) University of Technology Sydney(悉尼大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 本文提出T3-S2S方法,通过三元组微调实现可控概念艺术生成中的草图到场景合成,提升多实例场景生成的可控性和细节精度。

Comments https://openreview.net/forum?id=lyn2BgKQ8F

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06734 2026-02-09 cs.HC 50%

ClassAid: A Real-time Instructor-AI-Student Orchestration System for Classroom Programming Activities

ClassAid: 课堂编程活动中的实时教师-AI-学生协同系统

Gefei Zhang, Guodao Sun, Meng Xia, Ronghua Liang

专题命中 工作流自动化 :agent(abstract)

AI总结 ClassAid通过实时动态控制AI支持,为课堂编程活动提供个性化反馈,提升教师指导学生与AI互动的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06541 2026-02-09 cs.RO 50%

Primary Experimental Feedback on a Co-manipulated Robotic System for Assisted Cervical Surgery

对一种用于辅助颈椎手术的协同机器人系统的初步实验反馈

Seifeddine Sellemi, Abdelbadia Chaker, Tanguy Vendeuvre, Terence Essomba, Med Amine Laribi

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究评估了一种协同机器人系统在辅助颈椎手术钻孔任务中的性能,通过分析其轨迹执行精度,为临床应用提供可靠性和改进方向的反馈。

Journal ref The 7th IFToMM International Conference on Mechanisms, Transmissions, and Applications, Sep 2025, Taoyuan City, France. pp.147-155

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06301 2026-02-09 stat.ME stat.AP stat.CO 50%

Design-Conditional Prior Elicitation for Dirichlet Process Mixtures: A Unified Framework for Cluster Counts and Weight Control

设计条件先验引导的狄利克雷过程混合模型:一种用于聚类计数和权重控制的统一框架

JoonHo Lee

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出DCE框架,通过两阶段矩匹配解决DPM模型中浓度参数校准问题,减少后验崩溃并提高聚类计数与权重控制的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06200 2026-02-09 q-bio.PE nlin.AO physics.soc-ph 50%

Threshold Resource Redistribution in Spatially-Structured Kinship Networks

阈值资源再分配在空间结构的亲属网络中的应用

Alina Kochocki

专题命中 工作流自动化 :agent(abstract)

AI总结 该研究探讨了在空间受限条件下,基于亲属网络结构的资源再分配机制,揭示了资源密度、合作与亲属关系之间的相互作用。

Comments 39 pages, 8 figures. Submitted to Journal of Theoretical Biology

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 9 篇

2602.06875 2026-02-09 cs.SE cs.AI 88%

TraceCoder: A Trace-Driven Multi-Agent Framework for Automated Debugging of LLM-Generated Code

TraceCoder: 一个基于跟踪的多智能体框架,用于自动调试LLM生成的代码

Jiangping Huang, Wenguang Ye, Weisong Sun, Jian Zhang, Mingyue Zhang, Yang Liu

机构 * School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院) Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) Southwest University(西南大学)

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.SE

AI总结 TraceCoder通过多智能体框架和历史教训学习机制,提升LLM生成代码的自动调试效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21413 2026-02-09 cs.SE 85%

Context Engineering for AI Agents in Open-Source Software

面向开源软件的AI代理上下文工程

Seyedmoein Mohsenimofidi, Matthias Galster, Christoph Treude, Sebastian Baltes

专题命中 软件智能体 :AI agent(title,abstract);agent(abstract);agentic(abstract);分类 cs.SE

AI总结 本文研究了AI代理在开源软件中上下文文件的采用情况,发现其内容结构尚不统一,且存在多种提供方式,为研究上下文工程质量改进提供了新机会。

Comments 5 pages, 1 figure, 2 tables, 23rd IEEE/ACM International Conference on Mining Software Repositories (MSR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07865 2026-02-09 cs.SE cs.AI cs.CL cs.MA 80%

LLM-Powered Fully Automated Chaos Engineering: Towards Enabling Anyone to Build Resilient Software Systems at Low Cost

基于大语言模型的完全自动化混沌工程:实现任何人以低成本构建容错软件系统

Daisuke Kikuta, Hiroki Ikeuchi, Kengo Tajiri

机构 * NTT, Inc., Japan(日本NTT公司)

专题命中 软件智能体 :planning(abstract);workflow(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 本文提出ChaosEater系统,利用大语言模型自动化混沌工程周期,使任何人能低成本构建容错软件系统。

Comments Accepted at ASE 2025 NIER Track. The code is available at https://github.com/ntt-dkiku/chaos-eater

Journal ref 2025 40th IEEE/ACM International Conference on Automated Software Engineering (ASE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16975 2026-02-09 cs.SE cs.CL 73%

SWE-Dev: Evaluating and Training Autonomous Feature-Driven Software Development

SWE-Dev:评估和训练自主的基于特征驱动的软件开发

Yaxin Du, Yuzhu Cai, Yifan Zhou, Cheng Wang, Yu Qian, Xianghe Pang, Qian Liu, Yue Hu, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing University of Aeronautics and Astronautics(北京航空航天大学) The Chinese University of Hong Kong(香港中文大学) University of Michigan(密歇根大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.SE

AI总结 SWE-Dev是一个大规模数据集,用于评估和训练自主编码系统在特征驱动软件开发中的能力,通过提供可运行环境和单元测试提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02075 2026-02-09 cs.CE cs.LG 70%

MDAgent2: Large Language Model for Code Generation and Knowledge Q&A in Molecular Dynamics

MDAgent2:用于分子动力学中代码生成和知识问答的大型语言模型

Zhuofan Shi, Hubao A, Yufei Shao, Dongliang Huang, Hongxu An, Chunxiao Xin, Haiyang Shen, Zhenyu Wang, Yunshan Na, Gang Huang, Xiang Jing

机构 * Peking University(北京大学) National Key Laboratory of Data Space Technology and System(国家数据空间技术与系统重点实验室) The Hong Kong University of Science and Technology(香港科学与技术大学) Liaoning Technical University(辽宁技术大学) Wenjing Future Lab (Beijing) Technology Co., Ltd(文景未来实验室(北京)科技有限公司)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 MDAgent2是首个能同时进行分子动力学知识问答和代码生成的端到端框架,通过领域特定数据集和强化学习方法提升性能。

Comments 24 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20674 2026-02-09 cs.SE cs.PL 70%

LLM-Based Repair of Static Nullability Errors

基于大型语言模型的静态空性错误修复

Nima Karimipour, Pascal Joos, Michael Pradel, Martin Kellogg, Manu Sridharan

专题命中 软件智能体 :agent(abstract);workflow(abstract);分类 cs.SE

AI总结 基于LLM的NullRepair系统通过结构化工作流自动修复静态空性错误,有效解决残留问题并保留程序语义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06593 2026-02-09 cs.SE cs.AI 62%

AgentStepper: Interactive Debugging of Software Development Agents

AgentStepper: 软件开发代理的交互式调试

Robert Hutter, Michael Pradel

机构 * University of Stuttgart(斯图加特大学) CISPA Helmholtz Center for Information Security(CISPA 沃尔夫冈·泡利信息安全中心)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 AgentStepper是一种用于LLM软件工程代理的交互式调试工具,通过结构化对话和逐步执行提升调试效率,减少开发者工作量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16956 2026-02-09 cs.SE cs.LG 62%

SpIDER: Spatially Informed Dense Embedding Retrieval for Software Issue Localization

SpIDER:面向软件问题定位的时空感知密集嵌入检索

Shravan Chaudhari, Rahul Thomas Jacob, Mononito Goswami, Jiajun Cao, Shihab Rashid, Christian Bock

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) AWS(亚马逊公司) AWS AI Labs(亚马逊人工智能实验室)

专题命中 软件智能体 :agentic(abstract);分类 cs.LG、cs.SE

AI总结 SpIDER通过结合LLM推理和图结构探索信息,提升代码库中相关代码单元的密集检索性能,实验显示在多个编程语言和基准测试中性能提升达13%。

Comments Initial preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02735 2026-02-09 cs.CR cs.AI 57%

Meta SecAlign: A Secure Foundation LLM Against Prompt Injection Attacks

Meta SecAlign: 一种针对提示注入攻击的 secure LLM 基础

Sizhe Chen, Arman Zharmagambetov, David Wagner, Chuan Guo

机构 * FAIR at Meta(Meta 的 FAIR 部门) UC Berkeley(加州大学伯克利分校)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI

AI总结 Meta SecAlign 是首个开源的 LLM,具备内置的模型级防御,实现了商业级性能,且在复杂代理任务中表现优异,同时在提示注入攻击中展现出更高的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 3 篇

2512.22894 2026-02-09 cs.CR cs.AI 57%

DECEPTICON: How Dark Patterns Manipulate Web Agents

DECEPTICON:暗模式如何操纵网络代理

Phil Cuvin, Hao Zhu, Diyi Yang

机构 * Stanford University(斯坦福大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 DECEPTICON研究揭示暗模式通过引导代理轨迹对网络代理构成重大风险,表明需加强防御措施以应对操纵性设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06356 2026-02-09 cs.RO cs.SY eess.SY 50%

Nipping the Drift in the Bud: Retrospective Rectification for Robust Vision-Language Navigation

在源头遏制漂移:面向鲁棒视觉语言导航的回顾性校正

Gang He, Zhenyang Liu, Kepeng Xu, Li Xu, Tong Qiao, Wenxin Yu, Chang Wu, Weiying Xie

机构 * Xidian University(西安电子科技大学) Southwest University of Science and Technology(西南科技大学)

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 BudVLN通过回顾性校正和决策条件监督合成,有效缓解视觉语言导航中的分布偏移问题,提升鲁棒性与导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17815 2026-02-09 cs.RO 50%

Less Is More: Scalable Visual Navigation from Limited Data

少即是多:从有限数据实现可扩展的视觉导航

Yves Inglin, Jonas Frey, Changan Chen, Marco Hutter

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) UC Berkeley(伯克利加州大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出Less is More方法,通过结合有限专家示范与规划器生成的监督,实现高效视觉导航。

Comments v2: Minor text edits, reference formatting fixes, and project page link added

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 4 篇

2602.03595 2026-02-09 cs.CV 89%

Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation

Refer-Agent:一种具有推理和反思的协作多智能体系统用于指引用视频对象分割

Haichao Jiang, Tianming Liang, Wei-Shi Zheng, Jian-Fang Hu

机构 * Sun Yat-sen University(中山大学)

专题命中 记忆与上下文管理 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract)

AI总结 Refer-Agent通过协作多智能体系统结合推理与反思机制,提升指引用视频对象分割的性能与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18642 2026-02-09 cs.AI cs.CL 84%

FadeMem: Biologically-Inspired Forgetting for Efficient Agent Memory

FadeMem: 基于生物机制的高效代理记忆遗忘

Lei Wei, Xiao Peng, Xu Dong, Niantao Xie, Bin Wang

机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) School of Software and Microelectronics(软件与微电子学院) Peking University(北京大学)

专题命中 记忆与上下文管理 :agent(title,abstract);autonomous agent(abstract);分类 cs.AI、cs.CL

AI总结 FadeMem通过生物启发的主动遗忘机制,提升代理记忆的效率与存储容量,实现更有效的信息管理与多跳推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06923 2026-02-09 cs.LG cs.AI physics.class-ph 62%

From Kepler to Newton: Inductive Biases Guide Learned World Models in Transformers

从开普勒到牛顿:归纳偏置引导变换器中的学习世界模型

Ziming Liu, Sophia Sanborn, Surya Ganguli, Andreas Tolias

机构 * Stanford University(斯坦福大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文通过引入归纳偏置,使通用变换器能够学习世界模型,从开普勒到牛顿,实现从曲线拟合到物理定律发现的转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06191 2026-02-09 cs.RO cs.SY eess.SY 50%

Active Localization of Unstable Systems with Coarse Information

不稳定系统的粗信息主动定位

Ege Yuceel, Daniel Liberzon, Sayan Mitra

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种基于集估计器和Voronoi划分的主动定位算法,用于在粗略传感下恢复不稳定系统的初始状态并保证信息区域的稳定性。

Comments 10 pages, 4 figures, Accepted by International Conference on Hybrid Systems: Computation and Control (HSCC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 13 篇

2602.06345 2026-02-09 cs.CR cs.AI 85%

Zero-Trust Runtime Verification for Agentic Payment Protocols: Mitigating Replay and Context-Binding Failures in AP2

面向代理支付协议的零信任运行时验证:缓解AP2中的重放和上下文绑定失败

Qianlong Lan, Anuj Kaul, Shaun Jones, Stephanie Westrum

机构 * eBay Inc(eBay公司)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 本文提出了一种零信任运行时验证框架,通过动态生成非ces强制显式上下文绑定和一次性使用命令语义,以缓解AP2中的重放和上下文重定向攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18226 2026-02-09 cs.AI 79%

Yunjue Agent Tech Report: A Fully Reproducible, Zero-Start In-Situ Self-Evolving Agent System for Open-Ended Tasks

yunjue代理技术报告:一种完全可重现、零起点现场自我进化代理系统用于开放性任务

Haotian Li, Shijun Yang, Weizhen Qi, Silei Zhao, Rui Hua, Mingzhu Song, Xiaojian Yang, Chao Peng

机构 * Harbin Institute of Technology(哈尔滨工业大学) University of Science and Technology of China(中国科学技术大学)

专题命中 Agent评测 :agent(title,abstract);分类 cs.AI

AI总结 Yunjue代理系统通过现场自我进化范式实现零起点环境下开放性任务的可重现、自适应能力扩展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06340 2026-02-09 cond-mat.stat-mech cond-mat.soft 78%

Ornstein-Uhlenbeck information particle: A new candidate of active agent

信息粒子:一种新的活性代理候选者

Xin Song, Xiji Shao, Yanwen Zhu, Cheng Yang, Linli He, Shigeyuki Komura, Zhanglin Hou

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出了一种基于OU浴反馈控制的信息粒子,通过调整惯性效应和波动强度,实现两种不同运动模式,展示了其在活性代理中的潜力。

Comments 8 pages, 5 figures including 3 figures in main text and 2 figures in Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06714 2026-02-09 cs.HC 71%

PrefIx: Understand and Adapt to User Preference in Human-Agent Interaction

PrefIx: 在人机交互中理解并适应用户偏好

Jialin Li, Zhenhao Chen, Hanjun Luo, Hanan Salam

专题命中 Agent评测 :agent(title)

AI总结 PrefIx通过交互作为工具范式,评估智能体在人机交互中的偏好适应能力,提升用户体验和偏好对齐度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06955 2026-02-09 cs.LG 57%

Improving Credit Card Fraud Detection with an Optimized Explainable Boosting Machine

通过优化可解释提升机改善信用卡欺诈检测

Reza E. Fazel, Arash Bakhtiary, Siavash A. Bigdeli

机构 * ReDi School(ReDi学院)

专题命中 Agent评测 :workflow(abstract);分类 cs.LG

AI总结 本文通过优化可解释提升机算法,提升信用卡欺诈检测的准确性和可解释性,实验结果显示其在ROC-AUC指标上优于多种传统方法。

Comments 22 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05975 2026-02-09 cs.IR cs.CL 57%

SAGE: Benchmarking and Improving Retrieval for Deep Research Agents

SAGE:深度研究代理检索的基准测试与改进

Tiansheng Hu, Yilun Zhao, Canyu Zhang, Arman Cohan, Chen Zhao

机构 * NYU Shanghai(纽约大学上海校区) Yale University(耶鲁大学) Center for Data Science, New York University(纽约大学数据科学中心)

专题命中 Agent评测 :agent(abstract);分类 cs.CL

AI总结 SAGE基准测试评估了深度研究代理的检索能力,发现BM25在推理密集型检索中表现优于大语言模型检索器,并提出基于语料库的测试时扩展框架提升检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21798 2026-02-09 cs.CV cs.HC cs.LG 57%

An Evaluation of Hybrid Annotation Workflows on High-Ambiguity Spatiotemporal Video Footage

对高歧义时空视频 footage 的混合标注流程的评估

Juan Gutiérrez, Victor Gutiérrez, Ángel Mora, Silvia Rodriguez, José Luis Blanco

机构 * IPTC(信息处理与电信中心) Telecommunications Center, Escuela Técnica Superior de Ingenieros de Telecomunicación, Av. Complutense 30, 28040 Madrid, Spain(电信中心,电信工程师高级学院,Complutense大道30号,28040马德里,西班牙)

专题命中 Agent评测 :workflow(abstract);分类 cs.LG

AI总结 本文评估了混合标注流程在高歧义时空视频中的有效性,通过实验表明其能显著减少标注时间并提供更严谨的AI辅助工作流程评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19275 2026-02-09 cs.SE 57%

Mut4All: Fuzzing Compilers via LLM-Synthesized Mutators Learned from Bug Reports

Mut4All:通过从错误报告中学习的LLM合成变异器模糊编译器

Bo Wang, Pengyang Wang, Chong Chen, Ming Deng, Jieke Shi, Qi Sun, Chengran Yang, Youfang Lin, Zhou Yang, Junjie Chen, Jun Sun, David Lo

专题命中 Agent评测 :agent(abstract);分类 cs.SE

AI总结 Mut4All通过LLM合成变异器自动发现编译器错误,实现高效且跨语言的模糊测试

详情

展开后加载摘要…

URL PDF HTML 收藏