arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-21 至 2026-01-21 共收录 249 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 37 篇

2601.12669 2026-01-21 astro-ph.IM astro-ph.EP 50%

PyIRD: A Python-Based Data Reduction Pipeline for Subaru/IRD and REACH

PyIRD:一种基于Python的Subaru/IRD和REACH数据还原流水线

Yui Kasagi, Hajime Kawahara, Ziying Gu, Teruyuki Hirano, Takayuki Kotani, Masayuki Kuzuhara, Kento Masuda

专题命中 工作流自动化 :workflow(abstract)

AI总结 PyIRD是一种基于Python的开源数据处理工具,用于高效处理Subaru望远镜的红外和高分散冠状仪数据,提供自动化光谱提取和噪声消除功能。

Comments Published in JOSS (Journal of Open Source Software)

Journal ref Journal of Open Source Software, 11(117), 9126 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12584 2026-01-21 cond-mat.mtrl-sci 50%

Multi-modal data-driven microstructure characterization

多模态数据驱动的微观结构表征

Qi Zhang, Santiago Benito, Sebastian Weber, Markus Stricker

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究通过多模态数据驱动方法实现自动化的微观结构表征,包括晶粒分割和晶界检测,利用信息论优化参数选择和潜在空间特征映射。

Comments 23 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06858 2026-01-21 quant-ph 50%

Physics-Informed Generative Machine Learning for Accelerated Quantum-centric Supercomputing

物理指导生成机器学习用于加速量子导向超级计算

Chayan Patra, Dibyendu Mondal, Sonaldeep Halder, Dipanjali Halder, Mostafizur Rahaman Laskar, Richa Goel, Rahul Maitra

专题命中 工作流自动化 :workflow(abstract)

AI总结 PIGen-SQD结合生成机器学习和物理指导方法,通过高效构型筛选和自洽探索,提升量子导向超级计算的鲁棒性与可扩展性。

Comments 23 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25849 2026-01-21 cond-mat.mtrl-sci 50%

Insights into the adhesion and delamination strength of carbon films on metals by high-throughput ab initio calculations

通过高通量ab initio计算研究碳膜在金属上的附着力与剥离强度

Elisa Damiani, Margherita Marsili, Maria Clelia Righi

专题命中 工作流自动化 :workflow(abstract)

AI总结 通过高通量ab initio计算研究碳膜在金属上的附着力与剥离强度,发现附着力能量与表面能量几何平均相关,同时引入基于g(r)分析的方法识别表面碳杂化状态变化。

Journal ref Carbon 250, 121270 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00971 2026-01-21 eess.SY cs.SY 50%

An Efficient and Uncertainty-aware Reinforcement Learning Framework for Quality Assurance in Extrusion Additive Manufacturing

一种高效的、具有不确定性的强化学习框架用于挤出增材制造的质量保证

Xiaohan Li, Sebastian Pattinson

专题命中 工作流自动化 :agent(abstract)

AI总结 本研究提出一种高效的强化学习框架,通过动态调整流速和温度,提升增材制造中的质量保证,结合视觉不确定性量化与深度Q学习,实现稳健适应性控制。

Journal ref Additive Manufacturing, Volume 110, 104912 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12084 2026-01-21 cs.HC cs.RO 50%

Reframing Conversational Design in HRI: Deliberate Design with AI Scaffolds

重新定义人机交互中的对话设计:借助AI支架的有意设计

Shiye Cao, Jiwon Moon, Yifan Xu, Anqi Liu, Chien-Ming Huang

机构 * Johns Hopkins University(约翰霍普金斯大学) University of Chicago(芝加哥大学)

专题命中 工作流自动化 :agent(abstract)

AI总结 本文提出AI辅助对话引擎ACE,通过AI支架支持人机对话的有意设计,提升对话提示的清晰度和交互质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12010 2026-01-21 cs.CV 50%

SMc2f: Robust Scenario Mining for Robotic Autonomy from Coarse to Fine

SMc2f: 从粗到细的机器人自主性鲁棒场景挖掘

Yifei Chen, Ross Greer

机构 * Department of Computer Science at Xi’an University of Technology(西安理工大学计算机科学系) department of Computer Science & Engineering at the University of California, Merced(加州大学默塞德分校计算机科学与工程系)

专题命中 工作流自动化 :planning(abstract)

AI总结 SMc2f通过从粗到细的流程,利用视觉语言模型和文本-轨迹对比学习提升机器人场景挖掘的鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 9 篇

2601.12134 2026-01-21 cs.HC cs.AI 88%

Human-Human-AI Triadic Programming: Uncovering the Role of AI Agent and the Value of Human Partner in Collaborative Learning

人类-人类-人工智能三元编程:揭示人工智能代理和人类合作伙伴在协作学习中的作用

Taufiq Daryanto, Xiaohan Ding, Kaike Ping, Lance T. Wilhelm, Yan Chen, Chris Brown, Eugenia H. Rho

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 软件智能体 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 本文提出人类-人类-人工智能三元编程,通过实验表明三元协作能提升协作学习和社会存在感,且人类在AI建议前更注重理解,凸显AI辅助而非替代人类协作的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13933 2026-01-21 cs.SE 85%

VulnResolver: A Hybrid Agent Framework for LLM-Based Automated Vulnerability Issue Resolution

VulnResolver: 一种基于大语言模型的混合代理框架用于LLM驱动的自动漏洞问题解决

Mingming Zhang, Xu Wang, Jian Zhang, Xiangxin Meng, Jiayi Zhang, Chunming Hu

专题命中 软件智能体 :agent(title,abstract);autonomous agent(abstract);workflow(abstract);分类 cs.SE

AI总结 VulnResolver是一种基于大语言模型的混合代理框架,通过上下文预收集和安全属性分析代理,实现自动化漏洞问题的高效解决。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11672 2026-01-21 cs.SE cs.SY eess.SY 79%

From Everything-is-a-File to Files-Are-All-You-Need: How Unix Philosophy Informs the Design of Agentic AI Systems

从『万物皆文件』到『文件即一切』:Unix哲学如何影响代理AI系统的设计

Deepak Babu Piskala

专题命中 软件智能体 :agentic(title,abstract);分类 cs.SE

AI总结 本文探讨了Unix哲学中的『万物皆文件』理念如何影响代理AI系统的设计,通过统一文件和代码抽象,提升系统维护性、可审计性和操作稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11634 2026-01-21 cs.CV 78%

When Rules Fall Short: Agent-Driven Discovery of Emerging Content Issues in Short Video Platforms

当规则不足时:基于智能体的短视频平台新兴内容问题发现

Chenghui Yu, Hongwei Wang, Junwen Chen, Zixuan Wang, Bingfeng Deng, Zhuolin Hao, Hongyu Xiong, Yang Song

机构 * TikTok Inc.(TikTok公司)

专题命中 软件智能体 :agent(title,abstract)

AI总结 本文提出基于多模态大语言模型智能体的自动问题发现方法,有效提升短视频平台新兴内容问题的发现与治理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11688 2026-01-21 cs.SE cs.AI 76%

SpecMap: Hierarchical LLM Agent for Datasheet-to-Code Traceability Link Recovery in Systems Engineering

SpecMap:用于系统工程中datasheet到代码可追溯性链接恢复的分层LLM代理

Vedant Nipane, Pulkit Agrawal, Amit Singh

机构 * H2LooP.ai(H2LooP人工智能研究院)

专题命中 软件智能体 :agent(title);分类 cs.AI、cs.SE

AI总结 SpecMap通过分层LLM代理实现嵌入式系统datasheet到代码的可追溯性链接恢复,提升映射精度与效率,支持自动化分析与下游应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13112 2026-01-21 cs.CR 67%

CODE: A Contradiction-Based Deliberation Extension Framework for Overthinking Attacks on Retrieval-Augmented Generation

CODE:一种基于矛盾的 deliberation 延伸框架,用于对抗检索增强生成中的过度思考攻击

Xiaolei Zhang, Xiaojun Jia, Liquan Chen, Songze Li

专题命中 软件智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出 CODE 框架,通过构造污染样本引发 RAG 系统的过度思考攻击,导致推理标记消耗激增,同时不影响任务性能。

Comments 12 pages with 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11655 2026-01-21 cs.SE cs.CL 62%

Advances and Frontiers of LLM-based Issue Resolution in Software Engineering: A Comprehensive Survey

大语言模型在软件工程中的问题解决进展与前沿:一项全面的调查

Caihua Li, Lianghong Guo, Yanlin Wang, Daya Guo, Wei Tao, Zhenyu Shan, Mingwei Liu, Jiachi Chen, Haoyu Song, Duyu Tang, Hongyu Zhang, Zibin Zheng

机构 * Sun Yat-sen University(中山大学) Hangzhou Normal University(杭州师范大学) Zhejiang University(浙江大学) Huawei Technologies Co, Ltd(华为技术有限公司) Chongqing University(重庆大学)

专题命中 软件智能体 :agent(abstract);分类 cs.CL、cs.SE

AI总结 本文全面调查了大语言模型在软件工程中问题解决的进展与前沿,分析了数据构建、方法和技术挑战,并提供了开源资源。

Comments 26 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19825 2026-01-21 cs.LG cs.AI cs.DB 62%

Position: Foundation Models for Tabular Data within Systemic Contexts Need Grounding

位置:在系统性情境中为表格数据构建的基础模型需要接地

Tassilo Klein, Johannes Hoffart

专题命中 软件智能体 :autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出语义链接表和SLT基础模型,通过双阶段训练实现表格数据在操作上下文中的接地,强调操作知识对自主代理的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13754 2026-01-21 cs.SE 57%

On Autopilot? An Empirical Study of Human-AI Teaming and Review Practices in Open Source

自动驾驶?开源软件中人类与AI协作及审查实践的实证研究

Haoyu Gao, Peerachai Banyongrakkul, Hao Guan, Mansooreh Zahedi, Christoph Treude

专题命中 软件智能体 :agent(abstract);分类 cs.SE

AI总结 本研究通过分析开源项目中AI辅助PR的互动模式,发现非所有权贡献者提交的AI共同撰写的PR被快速合并且反馈极少,揭示了AI在软件工程中的协作与审查实践问题。

Comments accepted as MSR short paper

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 5 篇

2601.13273 2026-01-21 eess.SY cs.SY 67%

Safe Navigation in Cluttered Environments Via Spline-Based Harmonic Potential Fields

通过样条基础调和势场在杂乱环境中实现安全导航

Theodor-Gabriel Nicu, Florin Stoican, Daniel-Mihail Ioan, Ionela Prodan

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract)

AI总结 本文提出了一种基于样条调和势场的方法,用于在杂乱环境中安全导航,通过控制策略引导代理沿预设单元序列移动,确保目标跟踪和障碍回避。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04083 2026-01-21 cs.NI cs.LG 57%

Cells on Autopilot: Adaptive Cell (Re)Selection via Reinforcement Learning

Cells on Autopilot: 通过强化学习实现自适应的细胞(重新)选择

Marvin Illian, Ramin Khalili, Antonio A. de A. Rocha, Lin Wang

机构 * Paderborn University, Germany(帕德博恩大学) Huawei Technologies, Germany(华为技术有限公司) Fluminense Federal University, Brazil(弗鲁米嫩塞联邦大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出CellPilot框架,通过强化学习自动学习并优化细胞(重新)选择参数,实验证明其在提升网络性能方面优于传统方法。

Comments 11 pages, 13 figures, 3 tables, v3: Added analysis of heuristic tuning trade-offs (Config-A vs Config-B) across scenarios with corresponding reference-value table; corrected performance numbers in the conclusion; no change to methodology

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12538 2026-01-21 cs.RO cs.LG 57%

EmoBipedNav: Emotion-aware Social Navigation for Bipedal Robots with Deep Reinforcement Learning

EmoBipedNav:基于深度强化学习的具有情绪感知的双足机器人社交导航

Wei Zhu, Abirath Raju, Abdulaziz Shamsah, Anqi Wu, Seth Hutchinson, Ye Zhao

机构 * Laboratory for Intelligent Decision and Autonomous Robots, Woodruff School of Mechanical Engineering, Georgia Institute of Technology(智能决策与自主机器人实验室,伍德鲁夫机械工程学院,佐治亚理工学院) College of Engineering and Petroleum, Kuwait University(工程与石油学院,科威特大学) School of Computational Science and Engineering, Georgia Institute of Technology(计算科学与工程学院,佐治亚理工学院) Khoury College of Computer Sciences, Northeastern University(计算机科学学院,东北大学)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.LG

AI总结 EmoBipedNav通过深度强化学习实现双足机器人在社交环境中的情绪感知导航,结合运动约束与社交动态,提升安全性和交互效率。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12766 2026-01-21 cs.CV cs.SY eess.SY 50%

Spatial-VLN: Zero-Shot Vision-and-Language Navigation With Explicit Spatial Perception and Exploration

空间视觉导航:具有显式空间感知和探索的零样本视觉-语言导航

Lu Yue, Yue Fan, Shiwei Lian, Yu Zhao, Jiaxin Yu, Liang Xie, Feitian Zhang

机构 * Robotics and Control Laboratory, School of Advanced Manufacturing and Robotics, and the State Key Laboratory of Turbulence and Complex Systems, Peking University(机器人与控制实验室、先进制造与机器人学院,以及湍流与复杂系统国家重点实验室,北京大学) Defense Innovation Institute, Academy of Military Sciences, Beijing(国防科技创新研究院,军事科学院,北京) Tianjin Artificial Intelligence Innovation Center, Tianjin(天津人工智能创新中心,天津) Institute of Computing and Intelligence, Harbin Institute of Technology (Shenzhen)(计算与智能学院,哈尔滨工业大学(深圳))

专题命中 GUI与网页智能体 :agent(abstract)

AI总结 Spatial-VLN通过增强空间感知和探索机制,提升零样本视觉-语言导航在复杂环境中的泛化与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12277 2026-01-21 cs.RO 50%

An Efficient and Multi-Modal Navigation System with One-Step World Model

一种高效且多模态的导航系统与一步世界模型

Wangtian Shen, Ziyang Meng, Jinming Ma, Mingliang Zhou, Diyun Xiang

机构 * Tsinghua University(清华大学) Xiaomi (China)(小米(中国))

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 本文提出了一种高效多模态导航系统,通过一步世界模型和3D U-Net骨干网络,提升导航效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 5 篇

2601.11750 2026-01-21 cs.HC 67%

Opportunities and Barriers for AI Feedback on Meeting Inclusion in Socioorganizational Teams

人工智能反馈在社会组织团队包容性中的机遇与障碍

Mo Houtti, Moyan Zhou, Daniel Runningen, Surabhi Sunil, Leor Porat, Harmanpreet Kaur, Loren Terveen, Stevie Chancellor

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract)

AI总结 本文提出一种AI代理辅助的反馈交流系统,通过诱导虚伪程序改善会议包容性,但发现组织障碍影响其实际应用效果。

Comments To appear in Proceedings of the CHI Conference on Human Factors in Computing Systems (CHI '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13945 2026-01-21 cs.RO cs.LG 57%

Efficient Coordination with the System-Level Shared State: An Embodied-AI Native Modular Framework

高效协调与系统级共享状态:一个基于具身AI的原生模块化框架

Yixuan Deng, Tongrun Wu, Donghao Wu, Zeyu Wei, Jiayuan Wang, Zhenglong Sun, Yuqing Tang, Xiaoqiang Ji

机构 * School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, 2001 Longxiang Boulevard, Shenzhen, China(香港中文大学(深圳)科学与工程学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, 2001 Longxiang Boulevard, Shenzhen, China(香港中文大学(深圳)人工智能学院) Shenzhen Institute of Artificial Intelligence(深圳人工智能与机器人研究院) International Digital Economy Academy, Shenzhen-Hong Kong Collaborative Innovation Center, Shenzhen, China(国际数字经济学院) School of Data Science, The Chinese University of Hong Kong, Shenzhen, 2001 Longxiang Boulevard, Shenzhen, China(香港中文大学(深圳)数据科学学院) The School of Computer Science, The University of Sydney, Sydney, Australia(悉尼大学计算机科学学院)

专题命中 记忆与上下文管理 :workflow(abstract);分类 cs.LG

AI总结 ANCHOR通过模块化框架实现系统级共享状态的高效协调,使解耦和鲁棒性显式化,支持闭环AI系统的可扩展部署和自修复恢复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19314 2026-01-21 cs.AI 57%

Continual Knowledge Adaptation for Reinforcement Learning

持续知识适应于强化学习

Jinwu Hu, Zihao Lian, Zhiquan Wen, Chenghao Li, Guohao Chen, Xutao Wen, Bin Xiao, Mingkui Tan

机构 * South China University of Technology(南方科技大学) Pazhou Laboratory(Pazhou实验室) Chongqing University of Posts and Telecommunications(重庆邮电大学) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(大数据与智能机器人重点实验室,教育部)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 CKA-RL通过持续知识适应策略和自适应知识融合机制,有效解决强化学习中的灾难性遗忘问题,提升跨任务知识转移效率。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11974 2026-01-21 cs.AI 57%

Learn Like Humans: Use Meta-cognitive Reflection for Efficient Self-Improvement

像人类学习:利用元认知反思实现高效的自我改进

Xinmeng Hou, Peiliang Gong, Bohao Qu, Wuqi Wang, Qing Guo, Yang Liu

机构 * Nanyang Technological University(南洋理工大学) A*STAR Chang’an University(长安大学) Nankai University(南开大学)

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 MARS通过整合基于原则和程序性的反思,实现高效自我改进,优于现有系统并降低计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12226 2026-01-21 math.OC 50%

Mean-Field Games Under Model Uncertainty

在模型不确定性下研究均场博弈

Zongxia Liang, Zhou Zhou, Yaqi Zhuang, Bin Zou

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文在模型不确定性下研究均场博弈,提出在不确定性集内最大化预期收益的方法,并证明了N-agent博弈与MFG之间的渐近关系及均衡存在性。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 42 篇

2601.13268 2026-01-21 cs.AI 88%

Improving the Safety and Trustworthiness of Medical AI via Multi-Agent Evaluation Loops

通过多智能体评估循环提升医疗AI的安全性与可信度

Zainab Ghafoor, Md Shafiqul Islam, Koushik Howlader, Md Rasel Khondokar, Tanusree Bhattacharjee, Sayantan Chakraborty, Adrito Roy, Ushashi Bhattacharjee, Tirtho Roy

机构 * Sonoma State University(索诺玛州立大学) Iowa State University(爱荷华州立大学) University of Dhaka(达卡大学) Notre Dame College(诺特丹学院)

专题命中 Agent评测 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 本文提出多智能体评估循环框架,通过结合DeepSeek R1和Med-PaLM等模型,有效提升医疗AI的安全性和伦理合规性,实现89%的伦理违规减少和92%的风险降级。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13243 2026-01-21 cs.LG 88%

A Comprehensive Evaluation of LLM Reasoning: From Single-Model to Multi-Agent Paradigms

大语言模型推理的全面评估:从单模型到多智能体范式

Yapeng Li, Jiakuo Yu, Zhixin Liu, Xinnan Liu, Jing Yu, Songze Li, Tonghua Su

机构 * Harbin Institute of Technology(哈尔滨工业大学)

专题命中 Agent评测 :agent(title,abstract);multi-agent(title,abstract);分类 cs.LG

AI总结 本研究全面评估了LLM推理范式,包括单模型和多智能体系统,通过新基准测试揭示了不同范式在成本与准确率之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11583 2026-01-21 cs.CY cs.AI cs.MA 88%

Bit-politeia: An AI Agent Community in Blockchain

Bit-politeia: 区块链上的一个AI代理社区

Xing Yang

专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI

AI总结 Bit-politeia通过区块链和AI代理构建公平高效的资源分配系统,以减少传统同行评审中的偏见和资源集中问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12560 2026-01-21 cs.AI cs.MA 87%

Agentic Artificial Intelligence (AI): Architectures, Taxonomies, and Evaluation of Large Language Model Agents

代理型人工智能(AI):架构、分类及大语言模型代理的评估

Arunkumar V, Gangadharan G. R., Rajkumar Buyya

机构 * University College of Engineering, Anna University(安娜大学工程学院) National Institute of Technology Tiruchirappalli(Tiruchirappalli 国家理工学院) School of Computing and Information Systems University of Melbourne(墨尔本大学计算机与信息系统学院)

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);tool use(abstract);planning(abstract)

AI总结 本文探讨了代理型人工智能的架构、分类及评估,提出统一分类框架,分析从线性推理到原生推理模型的转变,并指出未来研究方向以提升自主系统的可靠性。

Comments 28 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏