arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-17 至 2025-12-17 共收录 73 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 31 篇

2507.01705 2025-12-17 cs.RO 50%

Efficient Collision Detection for Long and Slender Robotic Links in Euclidean Distance Fields: Application to a Forestry Crane

在欧几里得距离场中高效检测长而细的机械臂碰撞:应用于林业起重机

Marc-Philip Ecker, Bernhard Bischof, Minh Nhat Vu, Christoph Fröhlich, Tobias Glück, Wolfgang Kemmetmüller

机构 * Automation & Control Institute (ACIN), TU Wien(自动化与控制研究所(ACIN),维也纳技术大学) Center for Vision, Automation & Control, AIT Austrian Institute of Technology GmbH(视觉、自动化与控制中心,奥地利技术研究所)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种针对长细机械臂的高效碰撞检测算法,通过利用其细长结构提升运动规划效率,适用于林业起重机等大尺寸机械臂的应用。

Comments Accepted at IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07203 2025-12-17 math.OC 50%

Integrated Wind Farm Design: Optimizing Turbine Placement and Cable Routing with Wake Effects

集成风电场设计:考虑尾流效应的涡轮机布局与电缆路由优化

Jaap Pedersen, Niels Lindner, Daniel Rehfeldt, Thorsten Koch

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种考虑尾流效应的风电场布局与电缆路由优化方法,通过扩展的配额Steiner树问题模型,有效提高了风电场规划的效率和经济性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21744 2025-12-17 eess.SY cs.SY 50%

Assessing the Reliability Benefits of Energy Storage as a Transmission Asset

评估能源存储作为输电资产的可靠性收益

David Sehloff, Jonghwan Kwon, Mahdi Mehrtash, Todd Levin, Benjamin F. Hobbs

专题命中 规划决策 :planning(abstract)

AI总结 本文通过混合整数线性规划模型和概率可靠性评估,评估能源存储作为输电资产的可靠性收益,以量化比较其与传统输电投资的可靠性价值。

Comments Submitted to IEEE Transactions on Industry Applications

Journal ref IEEE Transactions on Industry Applications ( Volume: 61, Issue: 1, Jan.-Feb. 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07740 2025-12-17 cs.CV 50%

LSM: A Comprehensive Metric for Assessing the Safety of Lane Detection Systems in Autonomous Driving

LSM:用于评估自动驾驶中车道检测系统安全性的综合指标

Jörg Gamerdinger, Sven Teufel, Stephan Amann, Georg Volk, Oliver Bringmann

机构 * University of Tübingen, Faculty of Science, Department of Computer Science, Embedded Systems Group(图宾根大学,科学学院,计算机科学系,嵌入式系统组)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出LSM,一种用于评估自动驾驶中车道检测系统安全性的综合指标,考虑了场景语义、检测范围及车辆速度等因素,通过安全分数评估系统安全性。

Comments Accepted at IEEE VTC-Fall 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 多智能体 10 篇

2512.08743 2025-12-17 cs.AI cs.MA 91%

Single-Agent Scaling Fails Multi-Agent Intelligence: Towards Foundation Models with Native Multi-Agent Intelligence

单智能体扩展无法实现多智能体智能:迈向具有原生多智能体智能的基础模型

Shuyue Hu, Haoyang Yan, Yiqun Zhang, Yang Chen, Dongzhan Zhou, Lei Bai

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);AI agent(abstract);tool use(abstract)

AI总结 本文指出单智能体扩展无法实现多智能体智能,提出构建具有原生多智能体智能的基础模型的关键方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10400 2025-12-17 cs.MA cs.AI cs.CL 88%

Rethinking the Reliability of Multi-agent System: A Perspective from Byzantine Fault Tolerance

重新思考多智能体系统可靠性:从拜占庭容错的角度出发

Lifan Zheng, Jiawei Chen, Qinghong Yin, Jingyuan Zhang, Xinyi Zeng, Yu Tian

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI、cs.CL

AI总结 本文从拜占庭容错角度研究基于大语言模型的智能体可靠性,提出CP-WBFT机制提升多智能体系统稳定性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14112 2025-12-17 cs.AI 88%

STEMS: Spatial-Temporal Enhanced Safe Multi-Agent Coordination for Building Energy Management

STEMS: 基于空间-时间增强的安全多智能体协调的建筑能源管理

Huiliang Zhang, Di Wu, Arnaud Zinflou, Benoit Boulet

机构 * Department of Electrical Computer Engineering, McGill University(电气计算机工程系,麦吉尔大学) Data Science Team, Institut de Recherche Hydro Québec(水电研究所数据科学团队)

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.AI

AI总结 STEMS提出一种安全约束的多智能体强化学习框架,通过空间-时间图表示学习和控制屏障函数,提升建筑能源管理的效率与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14321 2025-12-17 cs.MA 88%

Multi-Agent Medical Decision Consensus Matrix System: An Intelligent Collaborative Framework for Oncology MDT Consultations

多智能体医疗决策共识矩阵系统:一种用于肿瘤多学科会诊的智能协作框架

Xudong Han, Xianglun Gao, Xiaoyi Qu, Zhenyu Yu

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 多智能体医疗决策共识矩阵系统通过智能体协作提升肿瘤多学科会诊的决策质量和效率。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04687 2025-12-17 cs.CV 88%

Guideline-Consistent Segmentation via Multi-Agent Refinement

通过多智能体细化实现指南一致的分割

Vanshika Vats, Ashwani Rathee, James Davis

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 本文提出一种多智能体无训练框架,通过Worker-Supervisor迭代细化架构实现指南一致的分割,有效应对复杂文本指南。

Comments To be published in The Fortieth AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14417 2025-12-17 cs.AI 83%

PortAgent: LLM-driven Vehicle Dispatching Agent for Port Terminals

PortAgent: 基于大语言模型的港口终端车辆调度代理

Jia Hu, Junqi Li, Weimeng Lin, Peng Jia, Yuxiong Ji, Jintao Lai

专题命中 多智能体 :agent(title,abstract);workflow(abstract);分类 cs.AI

AI总结 PortAgent利用大语言模型实现港口终端车辆调度系统的自动化迁移,无需专家参与,降低数据需求并加快部署速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14252 2025-12-17 cs.AI cs.LG 73%

Gödel's Poetry

哥德尔的诗歌

Kelly J. Davis

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种结合专用语言模型和递归分解技术的自动定理证明系统,显著提升了miniF2F的证明通过率。

Comments 24 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13923 2025-12-17 math.OC 67%

DAMA: A Unified Accelerated Approach for Decentralized Nonconvex Minimax Optimization-Part II: Convergence and Performance Analyses

DAMA:一种用于去中心化非凸极小极大优化的统一加速方法——第二部分:收敛性与性能分析

Haoyuan Cai, Sulaiman A. Alghunaim, Ali H. Sayed

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本研究提出DAMA算法,通过统一加速梯度估计器GRACE,提升去中心化非凸极小极大优化的收敛性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13920 2025-12-17 math.OC 67%

DAMA: A Unified Accelerated Approach for Decentralized Nonconvex Minimax Optimization-Part I: Algorithm Development and Results

DAMA:一种用于去中心化非凸极小极大优化的统一加速方法——第一部分:算法开发与结果

Haoyuan Cai, Sulaiman A. Alghunaim, Ali H. Sayed

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 DAMA是一种用于去中心化非凸极小极大优化的统一加速方法,整合了多种去中心化学习策略和加速梯度技术,实现了更灵活的框架和更优的性能界限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12977 2025-12-17 cs.AI cs.CL 62%

MindForge: Empowering Embodied Agents with Theory of Mind for Lifelong Cultural Learning

MindForge: 通过显式视角转换赋能具身智能体的终身文化学习

Mircea Lică, Ojas Shirekar, Baptiste Colle, Chirag Raman

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 多智能体 :agent(abstract);分类 cs.AI、cs.CL

AI总结 MindForge通过显式视角转换和多组件记忆系统,使智能体在Minecraft中实现文化终身学习,显著提升基础任务表现并适应新任务。

Comments Accepted to NeurIPS 2025 main track as poster

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 工作流自动化 14 篇

2512.14429 2025-12-17 cs.AI cs.SE 84%

Seismology modeling agent: A smart assistant for geophysical researchers

地震建模代理:为地球物理研究者设计的智能助手

Yukun Ren, Siwei Yu, Kai Chen, Jianwei Ma

专题命中 工作流自动化 :agent(title,abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 本文提出基于LLMs的SPECFEM智能交互工作流程,通过MCP协议降低地震模拟门槛,提升地球物理研究的自动化与可重复性。

Comments 26 pages, 15 figures. Code available at https://github.com/RenYukun1563/specfem-mcp

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14092 2025-12-17 cs.CV cs.AI 79%

ProtoFlow: Interpretable and Robust Surgical Workflow Modeling with Learned Dynamic Scene Graph Prototypes

ProtoFlow: 基于学习动态场景图原型的可解释且鲁棒的手术流程建模

Felix Holm, Ghazal Ghazaei, Nassir Navab

机构 * Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心(MCML))

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 ProtoFlow通过学习动态场景图原型,实现了手术流程的可解释和鲁棒建模,提升了AI在手术培训和决策支持中的应用潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14233 2025-12-17 cs.SE cs.AI cs.CR 73%

PentestEval: Benchmarking LLM-based Penetration Testing with Modular and Stage-Level Design

PentestEval: 一种基于模块化和阶段级设计的LLM渗透测试基准测试

Ruozhao Yang, Mingfei Cheng, Gelei Deng, Tianwei Zhang, Junjie Wang, Xiaofei Xie

机构 * School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡国立管理大学) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学) School of Cyber Security, Tianjin University(网络安全学院,天津大学)

专题命中 工作流自动化 :autonomous agent(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 PentestEval通过模块化和阶段级设计,评估LLM在渗透测试各阶段的性能,揭示其在自动化测试中的局限性。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14453 2025-12-17 cs.SE cs.CR 57%

Aligning Security Compliance and DevOps: A Longitudinal Study

对齐安全合规与DevOps:一项纵向研究

Fabiola Moyón, Florian Angermeir, Daniel Mendez, Tony Gorschek, Markus Voggenreiter, Pierre-Louis Bonvin

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 本文提出了一种基于安全标准的DevOps框架,通过纵向研究展示其在关键基础设施产品开发中的应用及对实践的影响。

Journal ref Journal of Systems and Software, Volume 234, 2026, 112718, ISSN 0164-1212

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06453 2025-12-17 cs.CV cs.AI 57%

Text Embedded Swin-UMamba for DeepLesion Segmentation

文本嵌入的Swin-UMamba用于深度病变分割

Ruida Cheng, Tejas Sudharshan Mathai, Pritam Mukherjee, Benjamin Hou, Qingqing Zhu, Zhiyong Lu, Matthew McAuliffe, Ronald M. Summers

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出Text-Swin-U/Mamba模型,通过整合文本信息提升深度病变分割的精度,实验结果显示其在Dice分数和Hausdorff距离上均优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13716 2025-12-17 cs.AI 57%

ValuePilot: A Two-Phase Framework for Value-Driven Decision-Making

ValuePilot:一种面向价值驱动决策的双阶段框架

Yitong Luo, Ziang Chen, Hou Hei Lam, Jiayu zhan, Junqi Wang, Zhenliang Zhang, Xue Feng

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(1 通用人工智能国家重点实验室,BIGAI) Tsinghua University(2 清华大学) Peking University(3 北京大学)

专题命中 工作流自动化 :AI agent(abstract);分类 cs.AI

AI总结 ValuePilot通过双阶段框架实现价值驱动的个性化决策,提升AI在复杂场景中的可解释性和适应性。

Comments Accepted at LAW Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14920 2025-12-17 quant-ph cs.LG 57%

Q2SAR: A Quantum Multiple Kernel Learning Approach for Drug Discovery

Q2SAR:用于药物发现的量子多核学习方法

Alejandro Giraldo, Daniel Ruiz, Mariano Caruso, Javier Mancilla, Guido Bellomo

机构 * Technologies Delaware, USA

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 Q2SAR通过量子多核学习方法提升QSAR分类性能,展示在药物发现中的量子优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13064 2025-12-17 physics.geo-ph stat.AP 50%

The EEPAS Model Revisited: Statistical Formalism and a High-Performance, Reproducible Open-Source Framework

EEPAS模型再审视:统计形式化及高性能可重复开源框架

Szu-Chi Chung, Chien-Hong Cho, Strong Wen

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出一个高性能开源框架,用于中长期地震预测模型EEPAS和PPE的统计形式化与实现,提供可重复的分析工具和标准化评估方法。

Comments 32 pages, 9 Figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21245 2025-12-17 cond-mat.mtrl-sci 50%

Database and deep-learning scalability of anharmonic phonon properties by automated brute-force first-principles calculations

通过自动化暴力第一性原理计算实现声子非谐性性质的数据库和深度学习可扩展性

Masato Ohnishi, Tianqi Deng, Pol Torres, Zhihao Xu, Terumasa Tadano, Haoming Zhang, Wei Nong, Masatoshi Hanai, Zeyu Wang, Zhiting Tian, Ming Hu, Xiulin Ruan, Ryo Yoshida, Toyotaro Suzumura, Lucas Lindsay, Alan J. H. McGaughey, Tengfei Luo, Kedar Hippalgaonkar, Junichiro Shiomi

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究通过自动化第一性原理计算构建数据库,并利用图神经网络预测材料热导率,揭示了非谐声子性质与热导率的标度关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21230 2025-12-17 cs.LO 50%

Kimina Lean Server: A High-Performance Lean Server for Large-Scale Verification

Kimina Lean Server: 一种高性能的大型验证用Lean服务器

Marco Dos Santos, Hugues de Saxcé, Haiming Wang, Ran Wang, Mantas Baksys, Mert Unsal, Junqi Liu, Zhengying Liu, Jia Li

专题命中 工作流自动化 :workflow(abstract)

AI总结 Kimina Lean Server通过高效的并行处理和缓存机制,提升了大规模验证和数据提取的效率,适用于强化学习管道中的高性能验证任务。

Comments Accepted to the 5th MATH-AI Workshop at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13826 2025-12-17 cond-mat.mtrl-sci 50%

Reproducible container solutions for codes and workflows in materials science

用于材料科学代码和工作流的可重复容器解决方案

Dylan Bissuel, Léo Orveillon, Benjamin Arrondeau, Paulo Almeida De Mendonça, Irina Piazza, Martin Uhrin, Étienne Polack, Akshay Krishna Ammothum Kandy, David Martin-Calle, Jonathan Chapignac, Aadhityan Arivazhagan, Lorenzo Paulatto, Pierre-Antoine Bouttier, M. -I Richard, Thierry Deutsch, David Rodney, A M Saitta, Nöel Jakse

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种结合GNU Guix和Apptainer的可重复容器解决方案,用于构建可信赖的计算材料科学工作流环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13392 2025-12-17 cs.CV 50%

Beyond the Visible: Disocclusion-Aware Editing via Proxy Dynamic Graphs

超越可见范围:通过代理动态图实现的遮挡感知编辑

Anran Qi, Changjian Li, Adrien Bousseau, Niloy J. Mitra

机构 * Inria - Université Côte d’Azur(法国国家信息与自动化技术研究院-埃克塞特大学) University of Edinburgh(爱丁堡大学) Adobe Research(Adobe研究部) UCL(伦敦大学学院)

专题命中 工作流自动化 :workflow(abstract)

AI总结 通过代理动态图实现遮挡感知编辑,结合运动规范与外观合成,实现可控的图像到视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02503 2025-12-17 cs.CV 50%

Adapting General-Purpose Foundation Models for X-ray Ptychography in Low-Data Regimes

为低数据情形下的X射线衍射成像适应通用基础模型

Robinson Umeike, Neil Getty, Yin Xiangyu, Yi Jiang

机构 * The University of Alabama(阿拉巴马大学) Argonne National Laboratory(阿贡国家实验室)

专题命中 工作流自动化 :agentic(abstract)

AI总结 本文提出PtychoBench基准,通过比较SFT和ICL策略,在低数据环境下优化X射线衍射成像任务的模型适应性,发现任务模态决定最佳专门化路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02439 2025-12-17 cs.CV 50%

Glioblastoma Overall Survival Prediction With Vision Transformers

使用视觉变换器预测胶母细胞瘤总体生存率

Yin Lin, Riccardo Barbieri, Domenico Aquino, Giuseppe Lauria, Marina Grisoli, Elena De Momi, Alberto Redaelli, Simona Ferrante

机构 * Department of Electronic, Information and Bioengineering, Politecnico di Milano(电子、信息与生物工程系,米兰理工大学) Department of Neuroradiology, Fondazione IRCCS Istituto Neurologico Carlo Besta(放射学系,IRCCS神经科学卡洛·贝斯塔研究所)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出利用视觉变换器直接从MRI图像中提取特征,无需肿瘤分割,实现胶母细胞瘤总体生存率的高效预测。

Comments 4 pages, 4 figures, EMBC2025

Journal ref Annual International Conference of the IEEE Engineering in Medicine and Biology Society (EMBC), 2025, pp. 1-4

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 软件智能体 3 篇

2412.17744 2025-12-17 cs.SE cs.AI cs.CL 67%

RepoTransBench: A Real-World Multilingual Benchmark for Repository-Level Code Translation

RepoTransBench: 一个面向真实世界的多语言代码仓库翻译基准

Yanli Wang, Yanlin Wang, Suiquan Wang, Daya Guo, Jiachi Chen, John Grundy, Xilin Liu, Yuchi Ma, Mingzhi Mao, Hongyu Zhang, Zibin Zheng

机构 * Sun Yat-sen University, China(中山大学) Monash University, Australia(墨尔本大学) Huawei Cloud Computing Technologies Co., Ltd, China(华为云计算技术有限公司) Chongqing University, China(重庆大学)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.SE

AI总结 RepoTransBench提出一个现实世界多语言代码仓库翻译基准,评估代码仓库级翻译的挑战,揭示不同语言对方向的翻译难度差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20333 2025-12-17 math.OC cs.GT 50%

Semidefinite network games: multiplayer minimax and complementarity problems

半定网络博弈:多玩家极小极大与互补性问题

Constantin Ickstadt, Thorsten Theobald, Elias Tsigaridas, Antonios Varvitsiotis

专题命中 软件智能体 :agent(abstract)

AI总结 本文研究了半定网络博弈,探讨了多玩家极小极大与互补性问题,提出纳什均衡的表征方法及零和博弈的判定条件。

Comments Revised version, 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏