arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-02 至 2025-12-02 共收录 145 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 29 篇

2512.00243 2025-12-02 econ.TH cs.AI cs.MA 70%

Optimizing Information Asset Investment Strategies in the Exploratory Phase of the Oil and Gas Industry: A Reinforcement Learning Approach

在油气行业的勘探阶段优化信息资产投资策略:一种强化学习方法

Paulo Roberto de Melo Barros Junior, Monica Alexandra Vilar Ribeiro De Meireles, Jose Luis Lima de Jesus Silva

机构 * ISCTE Business School(ISCTE商学院) Oxaala Technologies(Oxaala技术公司)

专题命中 多智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文通过强化学习方法,提出在油气勘探早期优先获取高质量信息资产的策略,以减少冗余成本并提高储量估值精度,挑战传统投资策略的经济效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01081 2025-12-02 cs.AI cs.CL cs.LG cs.MA cs.NE q-bio.NC 67%

Testing the Machine Consciousness Hypothesis

检验机器意识假说

Stephen Fitz

机构 * California Institute for Machine Consciousness(加利福尼亚机器意识研究所)

专题命中 多智能体 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文提出通过研究分布式系统中集体智能的对齐机制,探讨机器意识的产生源于交流而非建模。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00463 2025-12-02 math.RA cs.NA math.DS math.NA 67%

Necessary and Sufficient Criterion for Singular or Nonsingular of Diagonally Dominant Matrices

对对角占优矩阵奇异或非奇异性的必要和充分准则

Jidong Jin

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出对对角占优矩阵奇异性的必要和充分条件,通过角度方程组和相似性分析,结合网络动力系统等应用,解决矩阵奇异性的判定问题。

Comments 21 pages,0 figures

Journal ref Science China: Mathematics, 2014, 44(11). Vol. 44, No. 11, 2014. C

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08512 2025-12-02 cs.CV cs.RO 67%

Have We Scene It All? Scene Graph-Aware Deep Point Cloud Compression

我们是否已经看到了一切?基于场景图的深度点云压缩

Nikolaos Stathoulopoulos, Christoforos Kanellakis, George Nikolakopoulos

机构 * Robotics and AI Group, Department of Computer, Electrical and Space Engineering, Luleå University of Technology(机器人与人工智能组,计算机、电子与航天工程系,卢勒阿大学技术学院)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出基于场景图的深度点云压缩框架,通过语义感知编码和结构化解码实现高效压缩,保留结构和语义信息,并支持多机器人系统中的下游应用。

Comments Please cite published version. 8 pages, 6 figures

Journal ref IEEE Robotics and Automation Letters, vol. 10, no. 12, pp. 12477-12484, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17100 2025-12-02 math.OC 67%

Social Optimization in Noncooperative Games under Central Regulation

非合作博弈中在中央调控下的社会优化

Kaixin Du, Min Meng, Xiaoming Hu

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种不精确零阶算法,用于解决非合作博弈在高层调控下的双层社会优化问题,证明了算法的亚线性收敛性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06349 2025-12-02 cs.LG cs.AI cs.MA 62%

Flexible Swarm Learning May Outpace Foundation Models in Essential Tasks

灵活的群体学习可能在关键任务上超越基础模型

Moein E. Samadi, Andreas Schuppert

机构 * Institute for Computational Biomedicine, RWTH Aachen University(计算生物医学研究所,亚琛工业大学) Center for Computational Life Sciences, RWTH Aachen University(计算生命科学中心,亚琛工业大学)

专题命中 多智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种去中心化的群体学习架构,通过多个小代理网络实现自我适应,以在动态环境中超越传统基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01978 2025-12-02 math.CO cs.DM 50%

Fault-tolerant mutual-visibility: complexity and solutions for grid-like networks

容错互见性:网格状网络的复杂性与解决方案

Serafino Cicerone, Gabriele Di Stefano, Sandi Klavžar, Gang Zhang

专题命中 多智能体 :agent(abstract)

AI总结 研究提出k-容错互见性概念,用于网格状网络中实现高效且保密的通信,通过分析其复杂性及计算难度,为网络可靠性提供理论支持。

Comments 25 pages, 3 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 7 篇

2512.01939 2025-12-02 cs.SE cs.AI 88%

An Empirical Study of Agent Developer Practices in AI Agent Frameworks

关于AI代理框架中代理开发者实践的实证研究

Yanlin Wang, Xinyi Xu, Jiachi Chen, Tingting Bi, Wenchao Gu, Zibin Zheng

机构 * Sun Yat-sen University(中山大学) Zhejiang University(浙江大学) The University of Melbourne(墨尔本大学) Technical University of Munich(慕尼黑技术大学)

专题命中 工作流自动化 :agent(title,abstract);AI agent(title,abstract);分类 cs.AI、cs.SE

AI总结 本文通过实证研究分析了基于LLM的代理框架在开发效率、功能抽象、学习成本、性能优化和可维护性方面的差异,揭示了开发者在选择和使用框架时的挑战与需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00214 2025-12-02 cs.CL 79%

Towards Corpus-Grounded Agentic LLMs for Multilingual Grammatical Analysis

迈向基于语料库的代理LLM用于多语言语法分析

Matej Klemen, Tjaša Arčon, Luka Terčon, Marko Robnik-Šikonja, Kaja Dobrovoljc

机构 * University of Ljubljana, Faculty of Computer and Information Science(卢布尔雅那大学计算机与信息科学学院) University of Ljubljana, Faculty of Arts(卢布尔雅那大学艺术学院) Jožef Stefan Institute(乔塞夫·斯塔芬研究所)

专题命中 工作流自动化 :agentic(title,abstract);分类 cs.CL

AI总结 本文提出基于语料库的代理LLM框架,用于多语言语法分析,通过数据驱动推理提升语法探究的可解释性和扩展性。

Comments Pre-print, submission under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19361 2025-12-02 cs.CL cs.AI cs.SC cs.SD eess.AS 76%

SpeechIQ: Speech-Agentic Intelligence Quotient Across Cognitive Levels in Voice Understanding by Large Language Models

SpeechIQ: 大型语言模型在语音理解中的跨认知层级语音智能商

Zhen Wan, Chao-Han Huck Yang, Yahan Yu, Jinchuan Tian, Sheng Li, Ke Hu, Zhehuai Chen, Shinji Watanabe, Fei Cheng, Chenhui Chu, Sadao Kurohashi

机构 * Kyoto University(京都大学) NVIDIA Carnegie Mellon University(卡内基梅隆大学) Institute of Science Tokyo(东京科学研究院)

专题命中 工作流自动化 :agentic(title);分类 cs.AI、cs.CL

AI总结 SpeechIQ是一种基于语音的智能评估框架,通过三个认知层级评估大型语言模型在语音理解中的能力,提供统一的比较和识别标注错误与幻觉。

Comments ACL 2025 main. Our Speech-IQ leaderboard is hosted at huggingface.co/spaces/nvidia/Speech-IQ-leaderboard. Speech-IQ Calculator: https://github.com/YukinoWan/SpeechIQ

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01609 2025-12-02 cs.SE 57%

GPTrace: Effective Crash Deduplication Using LLM Embeddings

GPTrace: 利用LLM嵌入实现高效的崩溃去重

Patrick Herter, Vincent Ahlrichs, Ridvan Açilan, Julian Horsch

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 GPTrace利用大型语言模型嵌入技术,通过计算崩溃相关数据的向量并输入聚类算法,实现高效的崩溃去重,优于传统方法。

Comments Original publication in 2026 IEEE/ACM 48th International Conference on Software Engineering (ICSE '26), April 12-18, 2026, Rio de Janeiro, Brazil. ACM, New York, NY, USA, 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00595 2025-12-02 cs.DC cs.AI cs.CR 57%

IslandRun: Privacy-Aware Multi-Objective Orchestration for Distributed AI Inference

IslandRun:面向分布式AI推理的隐私感知多目标编排

Bala Siva Sai Akhil Malepati

机构 * Bala Siva Sai Akhil Malepati(独立研究者)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 IslandRun通过多目标编排系统,在异构个人计算生态系统中实现隐私保护的分布式AI推理优化。

Comments 15 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00119 2025-12-02 cs.CR cs.AI 57%

NetDeTox: Adversarial and Efficient Evasion of Hardware-Security GNNs via RL-LLM Orchestration

NetDeTox: 通过RL-LLM协同实现对硬件安全GNN的对抗性高效逃避

Zeng Wang, Minghao Shao, Akashdeep Saha, Ramesh Karri, Johann Knechtel, Muhammad Shafique, Ozgur Sinanoglu

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院) NYU Abu Dhabi(纽约大学阿布扎克分校)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 NetDeTox通过RL-LLM协同实现对硬件安全GNN的高效对抗性逃避,减少重写次数和面积开销,提升安全性方案的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00091 2025-12-02 cs.CV 50%

Deep Filament Extraction for 3D Concrete Printing

深度纤维提取用于3D混凝土打印

Karam Mawas, Mehdi Maboudi, Pedro Achanccaray, Markus Gerke

机构 * Technische Universität Braunschweig, Institute of Geodesy and Photogrammetry(德累斯顿技术大学测绘与摄影测量研究所)

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种自动化方法,用于3D混凝土打印中纤维的质量控制,适用于挤出和喷射打印技术,且不依赖特定传感器。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 4 篇

2512.01010 2025-12-02 cs.MA cs.AI cs.LG cs.SE physics.comp-ph physics.flu-dyn 80%

Chain of Unit-Physics: A Primitive-Centric Approach to Scientific Code Synthesis

单元物理链:一种以基础原理为中心的科学代码合成方法

Vansh Sharma, Venkat Raman

机构 * University of Michigan(密歇根大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);multi-agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 本研究提出单元物理链框架,通过以基础原理为中心的多代理系统,有效解决科学代码生成中的可靠性问题,实现高精度和高效能的代码生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00371 2025-12-02 cs.GT cs.AI cs.LG cs.MA 73%

Evaluating LLMs in Open-Source Games

评估大型语言模型在开源游戏中的表现

Swadesh Sistla, Max Kleiman-Weiner

机构 * University of Washington(华盛顿大学)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文评估了LLMs在开源游戏中预测策略和分析合作策略形成的能力。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01119 2025-12-02 cs.LG cs.AI 62%

World Model Robustness via Surprise Recognition

通过惊喜识别提升世界模型鲁棒性

Geigh Zollicoffer, Tanush Chopra, Mingkuan Yan, Xiaoxu Ma, Kenneth Eaton, Mark Riedl

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.LG

AI总结 通过惊喜识别提升世界模型在噪声环境下的鲁棒性,增强自动驾驶模拟中智能体的稳定性与性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00135 2025-12-02 cs.IT math.IT 50%

An Information Geometric Approach to Fairness With Equalized Odds Constraint

基于信息几何的公平性方法与等概率约束

Amirreza Zamani, Ayfer Özgür, Mikael Skoglund

专题命中 软件智能体 :agent(abstract)

AI总结 本文提出基于信息几何的公平机制设计方法,通过等概率约束和几何结构优化,实现低相关性的公平性保障。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 5 篇

2509.20729 2025-12-02 cs.AI cs.HC cs.MA 88%

Robust, Observable, and Evolvable Agentic Systems Engineering: A Principled Framework Validated via the Fairy GUI Agent

鲁棒、可观测和可进化的代理系统工程:一种经过Fairy GUI代理验证的原则性框架

Jiazheng Sun, Ruimeng Yang, Xu Han, Jiayang Niu, Mingxuan Li, Te Yang, Yongyong Lu, Xin Peng

机构 * Fudan University(复旦大学)

专题命中 GUI与网页智能体 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 本文提出了一种原则性框架,通过Fairy GUI代理验证,解决了代理系统在鲁棒性、可观测性和可进化性方面的不足,提供了可维护和可扩展的代理AI系统设计方法。

Comments 50 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00027 2025-12-02 cs.RO cs.AI cs.CV cs.HC 70%

A Survey on Improving Human Robot Collaboration through Vision-and-Language Navigation

通过视觉-语言导航提升人机协作的综述

Nivedan Yakolli, Avinash Gautam, Abhijit Das, Yuankai Qi, Virendra Singh Shekhawat

机构 * Birla Institute of Technology and Science (BITS)(比拉理工学院和科学学院) Macquarie University(麦考瑞大学)

专题命中 GUI与网页智能体 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文综述了视觉-语言导航在提升人机协作中的最新进展,探讨了多机器人协作中的关键挑战,并提出通过先进NLU技术实现主动澄清和动态角色分配的未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00049 2025-12-02 cs.RO cs.AI 57%

Socially aware navigation for mobile robots: a survey on deep reinforcement learning approaches

面向移动机器人的社会感知导航:深度强化学习方法的综述

Ibrahim Khalil Kabir, Muhammad Faizan Mysorewala

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 本文综述了深度强化学习在社会感知导航中的应用,分析了关键技术和挑战,提出未来需结合多种方法并建立平衡的评估标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01009 2025-12-02 cs.RO cs.CV 50%

FOM-Nav: Frontier-Object Maps for Object Goal Navigation

FOM-Nav:用于目标导航的前沿-对象地图

Thomas Chabal, Shizhe Chen, Jean Ponce, Cordelia Schmid

机构 * Inria(法国国家信息与自动化技术研究院) Department of Computer Science, École normale supérieure (ENS-PSL, CNRS, Inria)(高等师范学院计算机科学系) Courant Institute of Mathematical Sciences and Center for Data Science, New York University(纽约大学Courant数学科学研究所和数据科学中心)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 FOM-Nav通过前沿-对象地图和视觉-语言模型提升机器人在未知环境中的目标导航效率,实现最先进的导航性能。

Comments Project page: https://www.di.ens.fr/willow/research/fom-nav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00041 2025-12-02 cs.RO cs.CV 50%

VISTAv2: World Imagination for Indoor Vision-and-Language Navigation

VISTAv2:室内视觉与语言导航的世界想象

Yanjia Huang, Xianshun Jiang, Xiangbo Gao, Mingyang Wu, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯农工大学)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 VISTAv2通过生成式世界模型实现室内视觉与语言导航的稳健规划,结合动作条件想象和在线价值图融合,提升导航效率与鲁棒性。

Comments 11 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 记忆与上下文管理 5 篇

2512.00851 2025-12-02 cs.LG cs.CY 70%

City-Conditioned Memory for Multi-City Traffic and Mobility Forecasting

多城市交通与移动预测的城 condition 记忆

Wenzhang Du

机构 * Department of Computer Engineering, Mahanakorn University of Technology, International College (MUTIC)(计算机工程系,马汉纳克罗恩科技大学国际学院)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 CityCond是一种轻量级城市条件记忆层,通过城市ID编码和共享内存银行提升多城市交通预测的准确性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00351 2025-12-02 cs.LG stat.ML 70%

Provable Memory Efficient Self-Play Algorithm for Model-free Reinforcement Learning

可证明的内存高效自博弈算法用于无模型强化学习

Na Li, Yuchen Jiao, Hangguan Shan, Shefeng Yan

机构 * College of Information Science and Electronic Engineering(信息科学与电子工程学院) Zhejiang University(浙江大学) School of Information and Electronics(信息与电子学院) Beijing Institute of Technology(北京理工大学) Institute of Acoustics(声学研究所) Chinese Academy of Sciences(中国科学院)

专题命中 记忆与上下文管理 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出了一种内存高效的自博弈算法,用于解决多智能体强化学习中的内存效率、样本复杂度和预热成本问题。

Comments ICLR 2024. arXiv admin note: substantial text overlap with arXiv:2110.04645 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00268 2025-12-02 math.OC 67%

Exact Decentralized Optimization via Explicit $\ell_1$ Consensus Penalties

通过显式ℓ₁一致性惩罚实现精确去中心化优化

Hong Wang

专题命中 记忆与上下文管理 :agent(abstract);autonomous agent(abstract)

AI总结 DP²G通过显式ℓ₁惩罚实现精确去中心化优化,兼具快速收敛与高效通信,适用于复合目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07338 2025-12-02 cs.AI cs.LG 62%

DeepPersona: A Generative Engine for Scaling Deep Synthetic Personas

DeepPersona: 一个用于扩展深度合成人设的生成引擎

Zhen Wang, Yufan Zhou, Zhongyan Luo, Lyumanshan Ye, Adam Wood, Man Yao, Saab Mansour, Luoshang Pan

机构 * UCSD(加州大学圣地亚哥分校) KU Leuven(鲁汶大学) SJTU(上海交通大学) University of Michigan(密歇根大学) Denison University(德尼森大学) Amazon(亚马逊) Meta

专题命中 记忆与上下文管理 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 DeepPersona通过双阶段分类学引导方法生成深度合成人设,提升LLM个性化和人类模拟的准确性与多样性。

Comments add an author[Update], 12 pages, 5 figures, accepted at LAW 2025 Workshop (NeurIPS 2025) Project page: https://deeppersona-ai.github.io/

Journal ref LAW 2025 Workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00249 2025-12-02 econ.TH cs.SI 50%

Endogenous Network Structures with Precision and Dimension Choices

内生网络结构与精度和维度选择

Nikhil Kumar

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了内生决定网络结构的社会学习模型,探讨了信号精度和维度选择对网络结构的影响及优化策略。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. Agent评测 25 篇

2512.00769 2025-12-02 cs.LG astro-ph.GA 88%

AI Agent for Source Finding by SoFiA-2 for SKA-SDC2

为SKA-SDC2设计的SoFiA-2源寻找AI代理

Xingchen Zhou, Nan Li, Peng Jia, Yingfeng Liu, Furen Deng, Shuanghao Shu, Ying Li, Liang Cao, Huanyuan Shan, Ayodeji Ibitoye

机构 * National Astronomical Observatories, Chinese Academy of Sciences(中国科学院国家天文台) Taiyuan University of Technology(太原理工大学) Shanghai Astronomical Observatory, Chinese Academy of Sciences(中国科学院上海天文台) Department of Physics, Guangdong Technion – Israel Institute of Technology(广东理工学院–以色列理工学院物理系) Centre for Space Research, North-West University(北开大学空间研究中心) Department of Physics and Electronics, Adekunle Ajasin University(阿德克努勒·阿贾辛大学物理与电子系)

专题命中 Agent评测 :agent(title,abstract);AI agent(title,abstract);分类 cs.LG

AI总结 本文提出基于SAC算法的AI代理,用于优化SoFiA-2在SKA-SDC2中的参数配置,以提高源提取性能。

Comments 20 pages, 10 figures, accepted by RAA

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21510 2025-12-02 cs.MA cs.AI 83%

Tool-RoCo: An Agent-as-Tool Self-organization Large Language Model Benchmark in Multi-robot Cooperation

Tool-RoCo: 一种基于机器人协作的大型语言模型自组织评估基准

Ke Zhang, Xiaoning Zhao, Ce Zheng, Jiahong Ning, Dandan Zhu, Wenqi Zhang, Chen Sun, Toshiharu Sugawara

专题命中 Agent评测 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 Tool-RoCo提出了一种评估大型语言模型在多机器人协作中自主性和协作能力的基准,通过四种不同自主性范式和三个任务测试工具使用效果。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏