arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-12 至 2025-12-12 共收录 66 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 12 篇

2512.10166 2025-12-12 cs.MA 88%

Emergent Collective Memory in Decentralized Multi-Agent AI Systems

去中心化多智能体AI系统中集体记忆的涌现

Khushiyant

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 研究揭示了去中心化多智能体系统中集体记忆的涌现机制,通过个体记忆与环境痕迹的协同作用,证明了记忆与痕迹在不同条件下的性能差异及临界密度预测。

Comments 23 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08842 2025-12-12 cs.DC 88%

Maple: A Multi-agent System for Portable Deep Learning across Clusters

Maple:一种用于跨集群便携式深度学习的多智能体系统

Molang Wu, Zhao Zhang

专题命中 多智能体 :agent(title,abstract);multi-agent(title,abstract)

AI总结 Maple通过多智能体系统根据用户自然语言输入生成正确的深度学习命令行,实现跨集群便携式深度学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09932 2025-12-12 cs.AI cs.HC 70%

Suzume-chan: Your Personal Navigator as an Embodied Information Hub

Suzume-chan: 你的个人导航员作为具身信息中心

Maya Grace Torii, Takahito Murakami, Shuka Koseki, Yoichi Ochiai

机构 * Doctoral Program in Informatics, University of Tsukuba(信息学博士项目,东京大学) Doctoral Program in Nursing Science, University of Tsukuba(护理科学博士项目,东京大学) Institute of Library, Information and Media Science, University of Tsukuba(图书馆、信息与媒体科学研究所,东京大学)

专题命中 多智能体 :agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 Suzume-chan通过具身交互实现人机知识共享,利用本地AI和对话技术提升信息传递的温度与连通性。

Comments 3 pages, 1 figure, This study will demonstrate at WISS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10700 2025-12-12 cs.RO 67%

On the Stabilization of Rigid Formations on Regular Curves

关于在正则曲线上稳定刚性编队的问题

Mohamed Elobaid, Shinkyu Park, Eric Feron

机构 * Engineering CEMSE, King Abdullah University of Science(工程学院,国王阿卜杜勒阿齐兹科技大学)

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文提出了一种随机多起点牛顿类算法,用于在正则曲线上的刚性编队稳定化,并通过数值模拟验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10654 2025-12-12 math.OC 67%

Strong Global Convergence of the Consensus-Based Optimization Algorithm

基于共识的优化算法的强全局收敛性

Sabrina Bonandin, Konstantin Riedl, Sara Veneruso

专题命中 多智能体 :agent(abstract);multi-agent(abstract)

AI总结 本文证明了基于共识的优化算法在特定条件下对全局极小值的强收敛性,并给出了超参数选择和收敛速率的分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10305 2025-12-12 cs.AI 57%

InfoCom: Kilobyte-Scale Communication-Efficient Collaborative Perception with Information Bottleneck

InfoCom: 千字级通信高效协作感知与信息瓶颈

Quanmin Wei, Penglin Dai, Wei Li, Bingyi Liu, Xiao Wu

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 InfoCom通过信息瓶颈原理实现通信高效协作感知,显著降低通信开销,提升自动驾驶环境感知精度。

Comments Accepted by the 40th AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 9 篇

2512.09939 2025-12-12 cs.MA cs.AI cs.LG 90%

Norm-Governed Multi-Agent Decision-Making in Simulator-Coupled Environments:The Reinsurance Constrained Multi-Agent Simulation Process (R-CMASP)

规范引导的多智能体决策在耦合环境中的应用:再保险约束的多智能体仿真过程(R-CMASP)

Stella C. Dong

机构 * Reinsurance Analytics(再保险分析)

专题命中 工作流自动化 :agent(title,abstract);multi-agent(title,abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 本文提出R-CMASP模型,通过规范引导和模拟器耦合机制,提升多智能体在再保险决策中的稳定性与合规性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10121 2025-12-12 cs.CL cs.AI cs.CY q-fin.GN 87%

Workflow is All You Need: Escaping the "Statistical Smoothing Trap" via High-Entropy Information Foraging and Adversarial Pacing

流程即一切:通过高熵信息觅食和对抗性节奏控制摆脱'统计平滑陷阱

Zhongjie Jiang

机构 * Zhongjie Jiang(江宗杰)

专题命中 工作流自动化 :workflow(title,abstract);agentic(abstract,comments);planning(abstract);分类 cs.AI、cs.CL

AI总结 本研究提出DeepNews框架,通过高熵信息觅食和对抗性节奏控制,解决LLMs在长文本生成中的幻觉、逻辑一致性和个性化表达难题,实验显示其在金融报道中表现优异。

Comments 22 pages, 8 figures. Includes an ecological validity blind test where the Agentic Workflow achieved a 25% acceptance rate in top-tier media, decisively outperforming the SOTA Zero-shot baseline (0%). Features the DNFO-v5 ontology

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10312 2025-12-12 cs.DC cs.AI 57%

High-Dimensional Data Processing: Benchmarking Machine Learning and Deep Learning Architectures in Local and Distributed Environments

高维数据处理:在本地和分布式环境中评估机器学习和深度学习架构

Julian Rodriguez, Piotr Lopez, Emiliano Lerma, Rafael Medrano, Jacobo Hernandez

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文研究了在本地和分布式环境中评估机器学习和深度学习架构在高维数据处理中的表现。

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10304 2025-12-12 cs.AI cs.ET 57%

Trustworthy Orchestration Artificial Intelligence by the Ten Criteria with Control-Plane Governance

基于十项准则的可信 orchestration 人工智能与控制平面治理

Byeong Ho Kang, Wenli Yang, Muhammad Bilal Amin

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 本文提出基于十项准则的可信 orchestration 人工智能框架,通过整合人类输入、语义一致性等要素,系统性地提升人工智能系统的可信度与可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09443 2025-12-12 cs.HC cs.AI math.OC 57%

Advancing Mathematical Research via Human-AI Interactive Theorem Proving

通过人机交互定理证明推进数学研究

Chenyi Li, Zhijian Lai, Dong An, Jiang Hu, Zaiwen Wen

机构 * Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心) Yau Mathematical Sciences Center, Tsinghua University(清华大学尤伊数学科学中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出了一种人机交互的定理证明流程,利用大语言模型辅助数学研究,通过案例研究展示其在流形优化与Grover算法间连接的探索能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10847 2025-12-12 cond-mat.mtrl-sci cond-mat.supr-con 50%

Large Language Models for Superconductor Discovery

大型语言模型用于超导体发现

Suman Itani, Yibo Zhang, Ranjit Itani, Jiadong Zang

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文利用大型语言模型构建超导体数据库并实现反向设计,通过微调模型在超导体分类和预测中取得优于传统方法的性能。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03712 2025-12-12 physics.ins-det hep-ex 50%

Simulation of MAPS and a MAPS-based Inner Tracker for the Super Tau-Charm Facility

MAPS及基于MAPS的内跟踪器的仿真研究:超tau-charm设施

Ruiyang Zhang, Dongwei Xuan, Jiajun Qin, Lei Zhao, Le Xiao, Xiangming Sun, Lailin Xu, Jianbei Liu

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出基于MAPS的内跟踪器设计,通过仿真验证其在超tau-charm设施中的性能,实现了高探测效率和高空间分辨率。

Comments 44 pages, 20 figures, 4 tables, revision submitted to NIM. A

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10116 2025-12-12 cs.RO 50%

Fast Functionally Redundant Inverse Kinematics for Robotic Toolpath Optimisation in Manufacturing Tasks

快速功能冗余逆运动学用于制造任务中机器人工具路径优化

Andrew Razjigaev, Hans Lohr, Alejandro Vargas-Uscategui, Peter King, Tirthankar Bandyopadhyay

机构 * CSIRO(澳大利亚联邦科学与工业研究组织)

专题命中 工作流自动化 :planning(abstract)

AI总结 本文提出了一种利用任务空间分解方法和阻尼最小二乘法的快速功能冗余逆运动学算法,用于优化机器人在非平面表面的冷喷涂工具路径。

Comments Published at the Australasian Conference on Robotics and Automation (ACRA 2025) https://ssl.linklings.net/conferences/acra/acra2025_proceedings/views/includes/files/pap149s2.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10074 2025-12-12 eess.SP 50%

Cost and Complexity as Barriers to RTLS Adoption in SMEs: A Survey and Analysis

实时定位系统在中小企业的采纳中成本和复杂性作为障碍:调查与分析

Peyman Moeini, Mark Coates

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文研究了实时定位系统在中小企业中的采纳障碍,发现成本和安装复杂性是主要限制因素,提出无线和模块化架构等设计方向以适应中小企业需求。

Comments 18 pages, 11 figures, 1 table. Survey of RTLS adoption barriers for small and medium-sized manufacturing enterprises

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 2 篇

2512.10540 2025-12-12 cs.RO 67%

Mr. Virgil: Learning Multi-robot Visual-range Relative Localization

Mr. Virgil:学习多机器人视觉范围相对定位

Si Wang, Zhehan Li, Jiadong Lu, Rong Xiong, Yanjun Cao, Yue Wang

机构 * Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制系统研究所) Huzhou Institute of Zhejiang University(浙江大学湖州研究院)

专题命中 软件智能体 :agent(abstract);multi-agent(abstract)

AI总结 Mr. Virgil通过图神经网络和可微分PGO后端实现多机器人视觉范围相对定位,提升定位精度与鲁棒性。

Comments Accepted by 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03420 2025-12-12 cs.CR cs.SE 57%

HarnessAgent: Scaling Automatic Fuzzing Harness Construction with Tool-Augmented LLM Pipelines

HarnessAgent:利用工具增强的LLM流水线实现自动模糊测试Harness构建的扩展

Kang Yang, Yunhang Zhang, Zichuan Li, Guanhong Tao, Jun Xu, Xiaojing Liao

专题命中 软件智能体 :agentic(abstract);分类 cs.SE

AI总结 HarnessAgent通过工具增强的LLM流水线实现全自动、可扩展的模糊测试Harness构建,提升生成成功率和代码检索效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 3 篇

2512.00846 2025-12-12 cs.CV 71%

AFRAgent : An Adaptive Feature Renormalization Based High Resolution Aware GUI agent

AFRAgent:一种基于自适应特征归一化的高分辨率感知GUI代理

Neeraj Anand, Rishabh Jain, Sohan Patnaik, Balaji Krishnamurthy, Mausoom Sarkar

机构 * Media and Data Science Research, Adobe(Adobe媒体与数据科学研究所)

专题命中 GUI与网页智能体 :agent(title)

AI总结 AFRAgent通过自适应特征归一化技术,在保持高分辨率细节的同时,实现了更高效的GUI自动化性能,比现有模型小四分之一。

Comments Accepted at WACV 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10934 2025-12-12 cs.RO cs.LG 57%

Curriculum-Based Reinforcement Learning for Autonomous UAV Navigation in Unknown Curved Tubular Conduit

基于课程的学习强化学习用于自主无人机在未知弯曲管状通道中的导航

Zamirddine Mari, Jérôme Pasquet, Julien Seinturier

机构 * DGA Techniques Navales - Direction Générale de l’Armement(法国国防总局海军技术部) LIRMM, TETIS, CNRS, Université de Montpellier Paul-Valéry(蒙彼利埃大学保罗-瓦莱里耶大学) LIS, CNRS, Université de Toulon(土伦大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出基于课程学习的强化学习方法,使无人机在未知弯曲管状环境中实现自主导航,通过结合激光雷达和视觉信息,克服部分可观测性挑战,提升导航稳定性与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13270 2025-12-12 cs.HC 50%

Screen Reader Programmers in the Vibe Coding Era: Adaptation, Empowerment, and New Accessibility Landscape

在 vibe 编程时代中的屏幕阅读程序设计师:适应、赋能与新的无障碍景观

Nan Chen, Luna K. Qiu, Arran Zeyu Wang, Zilong Wang, Yuqing Yang

专题命中 GUI与网页智能体 :AI agent(abstract)

AI总结 研究探讨了屏幕阅读程序员在vibe编程时代与AI代码助手的互动,发现其在效率提升与无障碍方面取得进展,但也面临意图传达、多视角管理等挑战,提出更包容的设计原则。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 记忆与上下文管理 3 篇

2510.15952 2025-12-12 cs.AI 57%

Executable Epistemology: The Structured Cognitive Loop as an Architecture of Intentional Understanding

可执行的元认知:结构化认知循环作为意图理解的架构

Myung Ho Kim

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出结构化认知循环(SCL)作为可执行的元认知框架,通过定义智能为持续的循环过程,重新定义智能为重构自身知识状态的能力,并在哲学、人工智能和认识论领域产生影响。

Comments v4: Clarified the structural role of 'Regulation' as a governing constraint distinct from the loop cycle. Revised Figures 1 and 2 for better architectural clarity and unified terminology

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10027 2025-12-12 math.NA cs.NA 50%

A Mass Preserving Numerical Scheme for Kinetic Equations that Model Social Phenomena

一种用于建模社会现象的动能方程质量守恒数值方案

Yassin Bahid, Eduardo Corona, Nancy Rodriguez

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种用于建模社会现象的动能方程质量守恒数值方案,通过高效且高保真的模拟方法,提升了多子系统模型的计算效率和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11752 2025-12-12 eess.SY cs.SY 50%

Consensus over Clustered Networks Using Intermittent and Asynchronous Output Feedback

在间歇性和异步输出反馈下实现集群网络的一致性

Federico M. Zegers, Sean Phillips

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文提出了一种在间歇性和异步输出反馈下实现集群网络一致性的策略,通过混合系统建模和Lyapunov分析确保一致性集的鲁棒稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. Agent评测 12 篇

2512.09964 2025-12-12 q-bio.GN 85%

Development of an Agentic AI Model for NGS Downstream Analysis Targeting Researchers with Limited Biological Background

面向生物背景有限研究者的NGS下游分析代理AI模型开发

Donghyeon Lee, Dongseok Kim, Seokhwan Ko, Seo-Young Park, Junghwan Cho

专题命中 Agent评测 :agentic(title,abstract);agent(abstract);AI agent(abstract)

AI总结 本文提出了一种面向生物背景有限研究者的代理AI模型,通过自动化NGS下游分析、文献支持的解释和高级分析方法推荐,实现从基础数据处理到假设验证的无缝过渡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17158 2025-12-12 cs.AI cs.CL 84%

ARE: Scaling Up Agent Environments and Evaluations

ARE:扩展代理环境和评估

Romain Froger, Pierre Andrews, Matteo Bettini, Amar Budhiraja, Ricardo Silveira Cabral, Virginie Do, Emilien Garreau, Jean-Baptiste Gaya, Hugo Laurençon, Maxime Lecanu, Kunal Malkan, Dheeraj Mekala, Pierre Ménard, Gerard Moreno-Torres Bertran, Ulyana Piterbarg, Mikhail Plekhanov, Mathieu Rita, Andrey Rusakov, Vladislav Vorotilov, Mengjue Wang, Ian Yu, Amine Benhalloum, Grégoire Mialon, Thomas Scialom

机构 * Meta Superintelligence Labs(Meta超级智能实验室)

专题命中 Agent评测 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 ARE平台通过Gaia2基准测试代理能力,强调需新架构和适应性计算策略以应对智能光谱的挑战。

Comments Updated authors order and acknowledgement

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20926 2025-12-12 cs.CV 78%

A deep learning model to reduce agent dose for contrast-enhanced MRI of the cerebellopontine angle cistern

一种深度学习模型用于降低对比增强MRI的脑干桥小脑角蛛网膜下隙剂剂量

Yunjie Chen, Rianne A. Weber, Olaf M. Neve, Stephan R. Romeijn, Erik F. Hensen, Jelmer M. Wolterink, Qian Tao, Marius Staring, Berit M. Verbist

专题命中 Agent评测 :agent(title,abstract)

AI总结 本研究提出一种深度学习模型,通过降低对比剂剂量提升脑干桥小脑角蛛网膜下隙MRI图像质量,实现低剂量下的病变检测与诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10195 2025-12-12 cs.CL cs.LG cs.MA 73%

AutoMedic: An Automated Evaluation Framework for Clinical Conversational Agents with Medical Dataset Grounding

AutoMedic: 一种用于具有医学数据集支撑的临床对话代理的自动化评估框架

Gyutaek Oh, Sangjoon Park, Byung-Hoon Kim

机构 * Yonsei University College of Medicine(延世大学医学院) Yonsei Institute for Digital Health(延世大学数字健康研究所) Yonsei University(延世大学) Institute of Behavioral Sciences in Medicine(医学行为科学研究所)

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.CL、cs.LG

AI总结 AutoMedic是一种基于医学数据集的自动化评估框架,用于评估临床对话代理的多方面性能,包括准确性、效率、同理心和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18271 2025-12-12 cs.CV cs.AI 70%

Beyond Words and Pixels: A Benchmark for Implicit World Knowledge Reasoning in Generative Models

超越文字和像素:生成模型中隐式世界知识推理的基准测试

Tianyang Han, Junhao Su, Junjie Hu, Peizhen Yang, Hengyu Shi, Junfeng Luo, Jialin Gao

机构 * MeiGen AI Team, Meituan(美团梅基因AI团队) Fudan University(复旦大学) D^{4} Lab(D⁴实验室) HHMI Janelia Research Campus(HHMI贾能实验室)

专题命中 Agent评测 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出PicWorld基准测试,用于评估生成模型在隐式世界知识和物理因果推理方面的能力,揭示了现有T2I模型在这些方面的局限性,并提出了证据基础的多代理评估器进行细粒度评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10863 2025-12-12 cs.CV cs.AI 57%

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 Agent评测 :planning(abstract);分类 cs.AI

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08868 2025-12-12 cs.AI 57%

EcomBench: Towards Holistic Evaluation of Foundation Agents in E-commerce

EcomBench: 向电子商务基础智能体的全面评估迈进

Rui Min, Zile Qiao, Ze Xu, Jiawen Zhai, Wenyu Gao, Xuanzhong Chen, Haozhen Sun, Zhen Zhang, Xinyu Wang, Hong Zhou, Wenbiao Yin, Bo Zhang, Xuan Zhou, Ming Yan, Yong Jiang, Haicheng Liu, Liang Ding, Ling Zou, Yi R. Fung, Yalong Li, Pengjun Xie

机构 * Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 EcomBench通过真实电子商务场景评估智能体的核心能力,提供动态测试环境以衡量其在实际决策中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏