arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-11-24 至 2025-11-24 共收录 53 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 6 篇

2511.16911 2025-11-24 cs.RO cs.MA 50%

Multi-UAV Swarm Obstacle Avoidance Based on Potential Field Optimization

基于势场优化的多无人机群避障

Yendo Hu, Yiliang Wu, Weican Chen

专题命中 多智能体 :planning(abstract)

AI总结 本文提出一种结合改进多机器人编队避障算法与优化单无人机路径规划的混合算法,有效提升多无人机群在静态环境中的避障能力和编队稳定性。

Comments 12 pages, 13 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 9 篇

2511.17190 2025-11-24 cs.CL cs.DB 70%

AutoLink: Autonomous Schema Exploration and Expansion for Scalable Schema Linking in Text-to-SQL at Scale

AutoLink:用于大规模文本到SQL的自主模式探索与扩展

Ziyang Wang, Yuanlei Zheng, Zhenbiao Cao, Xiaojin Zhang, Zhongyu Wei, Pei Fu, Zhenbo Luo, Wei Chen, Xiang Bai

专题命中 工作流自动化 :agent(abstract);autonomous agent(abstract);分类 cs.CL

AI总结 AutoLink通过自主代理框架实现大规模文本到SQL的模式探索与扩展,提升模式链接的召回率和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17417 2025-11-24 cs.SE cs.LG 62%

CREST: Improving Interpretability and Effectiveness of Troubleshooting at Ericsson through Criterion-Specific Trouble Report Retrieval

CREST:通过基于标准的故障报告检索提升爱立信故障排除的可解释性和有效性

Soroush Javdan, Pragash Krishnamoorthy, Olga Baysal

机构 * Carleton University(卡尔顿大学) Ericsson Canada Inc.(爱立信加拿大公司)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG、cs.SE

AI总结 CREST通过基于标准的故障报告检索方法,利用专门模型提升故障排除的有效性和可解释性,显著提高检索准确性与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16923 2025-11-24 cs.LG q-bio.GN 57%

A Hybrid Computational Intelligence Framework for scRNA-seq Imputation: Integrating scRecover and Random Forests

一种用于scRNA-seq补全的混合计算智能框架:整合scRecover和随机森林

Ali Anaissi, Deshao Liu, Yuanzhe Jia, Weidong Huang, Widad Alyassine, Junaid Akram

机构 * University of Technology Sydney, Australia(悉尼科技大学) University of Sydney, Australia(悉尼大学) Asia Pacific International College (APIC), Parramatta, NSW, Australia(亚太国际学院) Lincoln Institute of Higher Education (LIHE), Sydney, Australia(林肯高等教育研究所) The Institute of International Studies (TIIS), Sydney, Australia(国际研究学院)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出SCR-MF框架,结合scRecover和随机森林,实现scRNA-seq数据补全,兼顾准确性和效率,适用于中等规模单细胞数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03410 2025-11-24 eess.IV cs.AI cs.CV 57%

Augmentation-Based Deep Learning for Identification of Circulating Tumor Cells

基于增强的深度学习用于循环肿瘤细胞的识别

Martina Russo, Giulia Bertolini, Vera Cappelletti, Cinzia De Marco, Serena Di Cosimo, Petra Paiè, Nadia Brancati

机构 * Institute for High Performance Computing and Networking-National Research Council of Italy (ICAR-CNR)(高性能计算与网络研究所-意大利国家研究理事会)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本研究提出基于深度学习的CTC识别方法,利用明场图像和数据增强技术提升诊断准确性,实现无荧光标记的CTC检测。

Comments 20 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06746 2025-11-24 cs.LG stat.ME stat.ML 57%

A New Causal Rule Learning Approach to Interpretable Estimation of Heterogeneous Treatment Effect

一种新的因果规则学习方法用于可解释的异质治疗效应估计

Ying Wu, Hanzhong Liu, Kai Ren, Shujie Ma, Xiangyu Chang

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种因果规则学习方法,用于可解释性地估计心房间隔缺损的异质治疗效应,通过规则发现、选择和分析步骤提升模型的可解释性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17091 2025-11-24 stat.ME stat.AP 50%

ggskewboxplots: Enhanced Boxplots for Skewed Data in R

ggskewboxplots: 用于R中偏斜数据的增强箱线图

Mustafa Cavus

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出ggskewboxplots包,通过整合多种稳健且考虑偏斜性的箱线图变体,改进对偏斜数据的可视化分析,提升异常值检测的准确性。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16724 2025-11-24 quant-ph hep-th physics.comp-ph 50%

Navigating the Quantum Resource Landscape of Entropy Vector Space Using Machine Learning and Optimization

利用机器学习和优化导航熵向量空间的量子资源景观

Nothando Khumalo, Aman Mehta, William Munizzi, Prineha Narang

专题命中 工作流自动化 :agent(abstract)

AI总结 本文利用机器学习和优化方法研究熵向量空间中量子资源的动态,通过生成违反Ingleton不等式的量子电路,揭示了量子资源的特征模式,并确定了最大可达到的违反程度。

Comments 57 pages, 23 Figures, 3 Tables, 1 Computational Package

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16713 2025-11-24 quant-ph hep-ex hep-ph 50%

Quantum artificial intelligence for pattern recognition at high-energy colliders: Tales of Three "Quantum's"

高能碰撞机中的量子人工智能:三个“量子”的故事

Hideki Okawa

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文探讨了量子计算在高能物理中用于模式识别的应用,分析了三种量子技术的优劣及当前发展状况。

Comments 29 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06337 2025-11-24 q-bio.TO physics.med-ph 50%

Integrated Open-Source Framework for Simulation of Transcatheter Pulmonary Valves in Native Right Ventricular Outflow Tracts

用于模拟经导管原位肺动脉瓣在原发右心室流出道中的集成开源框架

Christopher N. Zelonis, Jalaj Maheshwari, Wensi Wu, Steve A. Maas, Seda Aslan, Kyle Sunderland, Stephen Ching, Ashley Koluda, Yuval Barak-Corren, Nicolas Mangine, Patricia M. Sabin, Andras Lasso, Devin W. Laurence, Christian Herz, Matthew J. Gillespie, Jeffrey A. Weiss, Matthew A. Jolley

专题命中 工作流自动化 :workflow(abstract)

AI总结 本研究提出了一种集成开源框架,用于快速模拟经导管原位肺动脉瓣置换,以指导患者特异性装置选择。

Comments 27 pages, 7 figures, 2 videos, Preprint submitted to Engineering with Computers

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 2 篇

2511.16787 2025-11-24 cs.CL cs.SE 88%

NALA_MAINZ at BLP-2025 Task 2: A Multi-agent Approach for Bangla Instruction to Python Code Generation

NALA_MAINZ 在 BLP-2025 任务 2 中的多智能体方法:用于孟加拉语指令到 Python 代码生成

Hossain Shaikh Saadi, Faria Alam, Mario Sanz-Guerrero, Minh Duc Bui, Manuel Mager, Katharina von der Wense

机构 * Johannes Gutenberg University Mainz(美因茨雅各布·冯·蒂泽大学) Saarland University(萨尔兰大学) University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 软件智能体 :agent(title,abstract);multi-agent(title,abstract);分类 cs.CL、cs.SE

AI总结 本文提出了一种基于多智能体的框架,通过生成和调试代理协同工作,实现从孟加拉语指令到 Python 代码的高效生成,并在 BLP-2025 任务中取得优异成绩。

Comments BLP 2025 Shared Task 2 - Code Generation in Bangla

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16709 2025-11-24 cs.CR cs.AI 77%

AutoBackdoor: Automating Backdoor Attacks via LLM Agents

AutoBackdoor: 通过LLM代理自动化后门攻击

Yige Li, Zhe Li, Wei Zhao, Nay Myat Min, Hanxun Huang, Xingjun Ma, Jun Sun

机构 * Singapore Management University(新加坡管理大学) The University of Melbourne(墨尔本大学) Fudan University(复旦大学)

专题命中 软件智能体 :agent(abstract);AI agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 AutoBackdoor通过LLM代理自动化后门攻击,实现高效触发器生成和毒化数据构建,验证了对抗防御的脆弱性。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 3 篇

2511.17131 2025-11-24 cs.SE cs.AI 86%

UI-CUBE: Enterprise-Grade Computer Use Agent Benchmarking Beyond Task Accuracy to Operational Reliability

UI-CUBE:超越任务准确性的企业级计算机使用代理基准测试到操作可靠性

Horia Cristescu, Charles Park, Trong Canh Nguyen, Sergiu Talmacel, Alexandru-Gabriel Ilie, Stefan Adam

机构 * UiPath Romania(UiPath罗马尼亚) UiPath UK(UiPath英国) UiPath France(UiPath法国)

专题命中 GUI与网页智能体 :agent(title,abstract);planning(abstract);workflow(abstract);分类 cs.AI、cs.SE

AI总结 UI-CUBE通过系统性测试揭示CUA在复杂流程中的性能断崖,表明内存管理等架构限制而非训练优化可解决

Comments 18 pages, 8 figures, 5 tables. Benchmark comprising 226 tasks across two difficulty tiers. Code and benchmark available at https://github.com/UiPath/uipath_enterprise_benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17225 2025-11-24 cs.RO cs.AI cs.CV 57%

TP-MDDN: Task-Preferenced Multi-Demand-Driven Navigation with Autonomous Decision-Making

TP-MDDN:任务优先的多需求驱动导航与自主决策

Shanshan Li, Da Huang, Yu He, Yanwei Fu, Yu-Gang Jiang, Xiangyang Xue

机构 * Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institution(上海创新机构)

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.AI

AI总结 TP-MDDN通过引入任务优先的多需求驱动导航与自主决策系统,提升复杂任务下的导航性能与环境理解能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06182 2025-11-24 cs.RO 50%

OpenVLN: Open-world Aerial Vision-Language Navigation

OpenVLN: 开放世界空中视觉语言导航

Peican Lin, Gan Sun, Chenxi Liu, Fazeng Li, Weihong Ren, Yang Cong

机构 * School of Automation Science and Engineering, South China University of Technology(华南理工大学自动化科学与工程学院) State Key Laboratory of Robotics, Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所机器人重点实验室) State Key Laboratory of Robotics and System, School of Mechanical Engineering and Automation, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机械工程与自动化学院机器人与系统重点实验室)

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 OpenVLN通过强化学习和长视距规划器提升无人机在复杂空中环境中的长视距导航能力。

Comments Content: 8 pages 4 figures, conference paper under review

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 记忆与上下文管理 3 篇

2409.11393 2025-11-24 cs.SE cs.AI cs.CR cs.MA 84%

LLM-Agent-UMF: LLM-based Agent Unified Modeling Framework for Seamless Design of Multi Active/Passive Core-Agent Architectures

LLM-Agent-UMF: 基于大语言模型的代理统一建模框架,用于无缝设计多主动/被动核心代理架构

Amine Ben Hassouna, Hana Chaari, Ines Belhaj

机构 * Mediterranean Institute of Technology(地中海技术研究所) South Mediterranean University(南地中海大学) National School of Computer Science(国家计算机科学学校) University of Manouba(曼努巴大学)

专题命中 记忆与上下文管理 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.SE

AI总结 LLM-Agent-UMF提出了一种基于大语言模型的代理统一建模框架,用于设计多主动/被动核心代理架构,解决了现有架构的模块化和术语不一致问题。

Comments 39 pages, 19 figures, 3 tables. Published in Information Fusion, Volume 127, March 2026, 103865. Part of the special issue "Data Fusion Approaches in Data-Centric AI for Developing Trustworthy AI Systems"

Journal ref Information Fusion 127 (2026) 103865

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17315 2025-11-24 cs.CL 79%

Humanlike Multi-user Agent (HUMA): Designing a Deceptively Human AI Facilitator for Group Chats

人样多用户代理(HUMA):为群聊设计一种欺骗性人类AI助理工具

Mateusz Jacniacki, Martí Carmona Serrat

机构 * Soofte Research(Soofte研究机构)

专题命中 记忆与上下文管理 :agent(title,abstract);分类 cs.CL

AI总结 HUMA是一种基于LLM的多用户对话促进者,通过事件驱动架构模拟人类交互,实现在自然群聊中与人类相当的质量并难以识别。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17054 2025-11-24 cs.CV 50%

RL-AD-Net: Reinforcement Learning Guided Adaptive Displacement in Latent Space for Refined Point Cloud Completion

RL-AD-Net: 基于强化学习的潜在空间自适应位移用于精细化点云补全

Bhanu Pratap Paregi, Vaibhav Kumar

机构 * GeoAI4Cities Lab, IISER Bhopal(GeoAI4Cities实验室,印度Bhopal IISER)

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 RL-AD-Net通过强化学习在潜在空间中优化点云补全,提升局部几何一致性,适用于多种补全网络。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. Agent评测 4 篇

2408.15511 2025-11-24 cs.RO cs.AI 83%

AeroVerse: UAV-Agent Benchmark Suite for Simulating, Pre-training, Finetuning, and Evaluating Aerospace Embodied World Models

AeroVerse:用于模拟、预训练、微调和评估航空航天具身世界模型的UAV-Agent基准套件

Fanglong Yao, Yuanchang Yue, Youzhi Liu, Xian Sun, Kun Fu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所) University of Chinese Academy of Sciences(中国科学院大学) School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子电气与通信工程学院) Key Laboratory of Target Cognition and Application Technology(TCAT), Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所目标认知与应用技术重点实验室)

专题命中 Agent评测 :agent(title,abstract);planning(abstract);分类 cs.AI

AI总结 AeroVerse是一个用于模拟、预训练、微调和评估航空航天具身世界模型的基准套件,包含多个数据集和评估指标,旨在推动航空航天具身智能的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21651 2025-11-24 cs.AI 70%

Can AI Perceive Physical Danger and Intervene?

AI能否感知物理危险并干预?

Abhishek Jindal, Dmitry Kalashnikov, R. Alex Hofer, Oscar Chang, Divya Garikapati, Anirudha Majumdar, Pierre Sermanet, Vikas Sindhwani

机构 * Google DeepMind Robotics(谷歌深Mind机器人技术)

专题命中 Agent评测 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种用于评估具身体验AI系统物理安全性的基准测试方法,通过生成逼真图像和视频来测试模型对安全风险的理解和干预能力,并开发了训练后范式以提升模型的安全推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16683 2025-11-24 cs.CL cs.AI 62%

How Well Do LLMs Understand Tunisian Arabic?

LLMs对突尼斯阿拉伯语的理解程度如何?

Mohamed Mahdi

专题命中 Agent评测 :AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究通过构建包含突尼斯阿拉伯语、标准阿拉伯语和英语的平行数据集,评估了多种LLMs在转写、翻译和情感分析任务上的表现,揭示了模型在理解突尼斯方言方面的差异与局限,强调了在AI系统中纳入低资源语言的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00133 2025-11-24 cs.NI cs.AI cs.LG 62%

A Reinforcement Learning-Based Telematic Routing Protocol for the Internet of Underwater Things

基于强化学习的水下物联网远程路由协议

Mohammadhossein Homaei, Mehran Tarif, Agustin Di Bartolo, Victor Gonzalez Morales, Mar Avila Vegas

机构 * University of Extremadura(埃斯特拉曼杜拉大学) University of Verona(威尼斯大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种基于强化学习的水下物联网远程路由协议RL-RPL-UA,通过动态目标函数优化网络性能,实验显示其在数据包交付率、能耗和网络寿命方面均优于传统方法。

Comments 8 Pages, 10 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏

7. 其他Agent 1 篇

2511.16769 2025-11-24 cs.HC 50%

Trust in AI emerges from distrust in humans: A machine learning study on decision-making guidance

对人工智能的信任源于对人类的不信任:一项关于决策指导的机器学习研究

Johan Sebastián Galindez-Acosta, Juan José Giraldo-Huertas

专题命中 其他Agent :AI agent(abstract)

AI总结 本研究通过机器学习探讨了人工智能在决策指导中的信任机制,发现对人类的不信任会促使人们转向AI,且AI在事实性情景中更受青睐。

Comments 36 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏