arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-23 至 2025-12-23 共收录 155 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 多智能体 18 篇

2512.18616 2025-12-23 cs.HC cs.AI cs.CR cs.MA 57%

DASH: Deception-Augmented Shared Mental Model for a Human-Machine Teaming System

DASH:基于共享心理模型的欺骗增强型人机协同系统

Zelin Wan, Han Jun Yoon, Nithin Alluru, Terrence J. Moore, Frederica F. Nelson, Seunghyun Yoon, Hyuk Lim, Dan Dongseong Kim, Jin-Hee Cho

机构 * US DEVCOM Army Research Laboratory(美国陆军研究实验室) Korea Institute of Energy Technology (KENTECH)(韩国能源技术研究所) The University of Queensland(昆士兰大学)

专题命中 多智能体 :AI agent(abstract);分类 cs.AI

AI总结 DASH通过引入欺骗机制增强人机协同系统的鲁棒性,有效检测内部威胁并提升任务成功率。

Comments 17 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18146 2025-12-23 cs.RO cs.AI cs.MA 57%

On Swarm Leader Identification using Probing Policies

基于探测策略的蜂群领头者识别

Stergios E. Bachoumas, Panagiotis Artemiadis

专题命中 多智能体 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种基于探测策略的蜂群领头者识别方法,利用TGR层和S5模型实现高效的领头者识别,并通过仿真和实际实验验证了其在对抗环境中的有效性。

Comments 13 pages, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17935 2025-12-23 cs.SD cs.LG eess.AS 57%

chatter: a Python library for applying information theory and AI/ML models to animal communication

chatter: 一个用于将信息论和AI/ML模型应用于动物交流的Python库

Mason Youngblood

专题命中 多智能体 :workflow(abstract);分类 cs.LG

AI总结 chatter库利用信息论和机器学习技术,通过高维潜在空间分析动物叫声,无需手动分类即可量化声音序列的复杂性和新颖性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 工作流自动化 19 篇

2509.25510 2025-12-23 cs.LG cs.AR 88%

EEsizer: LLM-Based AI Agent for Sizing of Analog and Mixed Signal Circuit

EEsizer: 基于LLM的模拟和混合信号电路尺寸设计AI代理

Chang Liu, Danial Chitnis

机构 * The University of Edinburgh(爱丁堡大学) The School of Engineering(工程学院) Institute for Integrated Micro and Nano Systems(集成微纳系统研究所)

专题命中 工作流自动化 :agent(title,abstract);AI agent(title,abstract);分类 cs.LG

AI总结 EEsizer是一种基于LLM的AI代理,通过整合大语言模型与电路仿真器和自定义数据分析功能,实现了模拟和混合信号电路尺寸设计的自动化,展示了在先进节点上的适应性和鲁棒性。

Journal ref IEEE Transactions on Circuits and Systems I: Regular Papers, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19387 2025-12-23 cs.CV cs.AI 79%

DSTED: Decoupling Temporal Stabilization and Discriminative Enhancement for Surgical Workflow Recognition

DSTED:解耦时间稳定性和辨别增强以实现手术流程识别

Yueyao Chen, Kai-Ni Wang, Dario Tayupo, Arnaud Huaulm'e, Krystel Nyangoh Timoh, Pierre Jannin, Qi Dou

机构 * Univ Rennes, Inserm, LTSI - UMR 1099(里昂大学,Inserm,LTSI - UMR 1099)

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.AI

AI总结 DSTED通过解耦时间稳定性和辨别增强,提升手术流程识别的准确性和鲁棒性。

Comments Early accepted to IPCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20366 2025-12-23 cs.SE cond-mat.mtrl-sci 79%

A Python workflow definition for computational materials design

用于计算材料设计的Python工作流定义

Jan Janssen, Janine George, Julian Geiger, Marnik Bercx, Xing Wang, Christina Ertural, Joerg Schaarschmidt, Alex M. Ganose, Giovanni Pizzi, Tilmann Hickel, Joerg Neugebauer

专题命中 工作流自动化 :workflow(title,abstract);分类 cs.SE

AI总结 本文提出Python工作流定义(PWD)以促进计算材料设计领域不同工作流管理系统的互操作性和可重现性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02930 2025-12-23 cs.DC 78%

iDDS: Intelligent Distributed Dispatch and Scheduling for Workflow Orchestration

iDDS:智能分布式调度用于工作流编排

Wen Guan, Tadashi Maeno, Aleksandr Alekseev, Fernando Harald Barreiro Megino, Kaushik De, Edward Karavakis, Alexei Klimentov, Tatiana Korchuganova, FaHui Lin, Paul Nilsson, Torre Wenaus, Zhaoyu Yang, Xin Zhao

专题命中 工作流自动化 :workflow(title,abstract)

AI总结 iDDS是一种智能分布式调度系统,通过整合数据感知执行和可编程工作流,实现大规模分布式科学计算中的高效工作流编排与自动化处理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23950 2025-12-23 cs.AI 70%

InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback

InterMT:基于人类反馈的多轮交错偏好对齐

Boyuan Chen, Donghai Hong, Jiaming Ji, Jiacheng Zheng, Bowen Dong, Jiayi Zhou, Kaile Wang, Juntao Dai, Xuyao Wang, Wenqi Chen, Qirui Zheng, Wenxin Li, Sirui Han, Yike Guo, Yaodong Yang

机构 * Institute for AI, Peking University(人工智能研究院,北京大学) State Key Laboratory of General Artificial Intelligence, Peking University(通用人工智能国家重点实验室,北京大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 工作流自动化 :workflow(abstract);agentic(abstract);分类 cs.AI

AI总结 InterMT通过多轮多模态交互的偏好数据集探索,旨在提升多模态大模型的交互能力,结合人类反馈和专家注释,揭示多轮扩展规律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12399 2025-12-23 cs.AI 70%

A Survey of Vibe Coding with Large Language Models

基于大语言模型的Vibe编码调研

Yuyao Ge, Lingrui Mei, Zenghao Duan, Tianhao Li, Yujia Zheng, Yiwei Wang, Lexin Wang, Jiayu Yao, Tianyu Liu, Yujun Cai, Baolong Bi, Fangda Guo, Jiafeng Guo, Shenghua Liu, Xueqi Cheng

机构 * Institute of Computing Technology Chinese Academy of Sciences(中国科学院计算技术研究所) Duke University(杜克大学) University of California Merced(加州大学默塞德分校) Peking University(北京大学) University of Queensland(昆士兰大学)

专题命中 工作流自动化 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文调研了基于大语言模型的Vibe编码方法,系统分析了其理论基础和五个开发模型,揭示了上下文工程与协作模式对成功的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19479 2025-12-23 cs.CV 67%

Emotion-Director: Bridging Affective Shortcut in Emotion-Oriented Image Generation

情绪导演:在情绪导向图像生成中弥合情感捷径

Guoli Jia, Junyao Hu, Xinwei Long, Kai Tian, Kaiyan Zhang, KaiKai Zhao, Ning Ding, Bowen Zhou

机构 * Tsinghua University(清华大学) The Hong Kong Polytechnic University(香港理工大学) China Unicom(中国联合通信) Shanghai Artificial Intelligence Lab(上海人工智能实验室)

专题命中 工作流自动化 :agent(abstract);workflow(abstract)

AI总结 Emotion-Director通过跨模态协作框架,结合MC-Diffusion和MC-Agent,提升情绪导向图像生成的准确性和表现力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18732 2025-12-23 cs.AI cs.LG stat.ML 62%

Counterfactual Basis Extension and Representational Geometry: An MDL-Constrained Model of Conceptual Growth

反事实基础扩展与表征几何:一种基于MDL约束的概念发展模型

Chainarong Amornbunchornvej

机构 * National Electronics and Computer Technology Center(国家电子与计算机技术中心)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于MDL约束的概念发展模型,通过几何框架解释概念扩展为误差驱动的基底扩展过程,强调反事实表示在学习中的作用及限制。

Comments First draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19161 2025-12-23 cs.CL 57%

From Speech to Subtitles: Evaluating ASR Models in Subtitling Italian Television Programs

从语音到字幕:评估ASR模型在意大利电视节目字幕中的表现

Alessandro Lucca, Francesco Pierri

机构 * Politecnico di Milano(米兰理工大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 本文评估了四种最先进的ASR模型在意大利电视节目字幕任务中的表现,发现其在真实生产环境中的性能仍有待提升,但可作为提升人类生产力的有力工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18670 2025-12-23 cs.LG 57%

Demonstration-Guided Continual Reinforcement Learning in Dynamic Environments

动态环境中的演示引导持续强化学习

Xue Yang, Michael Schukat, Junlin Lu, Patrick Mannion, Karl Mason, Enda Howley

机构 * School of Computer Science, University of Galway(Galway大学计算机科学学院)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 本研究提出演示引导持续强化学习(DGCRL),通过外部演示库指导智能体探索与适应,提升动态环境中的学习效率和知识迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19000 2025-12-23 cs.HC cs.AI cs.SY eess.SY 57%

An AI-Driven Multimodal Smart Home Platform for Continuous Monitoring and Assistance in Post-Stroke Motor Impairment

基于人工智能的多模态智能家庭平台:用于中风后运动功能障碍的持续监测与协助

Chenyu Tang, Ruizhi Zhang, Shuo Gao, Zihe Zhao, Zibo Zhang, Jiaqi Wang, Cong Li, Junliang Chen, Yanning Dai, Shengbo Wang, Ruoyu Juan, Qiaoying Li, Ruimou Xie, Xuhang Chen, Xinkai Zhou, Yunjia Xia, Jianan Chen, Fanghao Lu, Xin Li, Ninglli Wang, Peter Smielewski, Yu Pan, Hubin Zhao, Luigi G. Occhipinti

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 本文提出一种基于人工智能的多模态智能家庭平台,通过整合可穿戴设备和环境传感器,实现中风后患者运动功能的持续监测与智能协助,显著提升用户满意度。

Comments 5 figures, 41 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18318 2025-12-23 cs.MM cs.AI cs.CV cs.DC cs.NI 57%

Asynchronous Pipeline Parallelism for Real-Time Multilingual Lip Synchronization in Video Communication Systems

异步流水线并行用于实时多语言唇同步视频通信系统

Eren Caglar, Amirkia Rafiei Oskooei, Mehmet Kutanoglu, Mustafa Keles, Mehmet S. Aktas

机构 * Department of Data Science Big Data Yildiz Technical University Istanbul, Turkey Department of Computer Engineering Yildiz Technical University Istanbul, Turkey R\&D Center Aktif Investment Bank Inc. Istanbul, Turkey 3.5cm R\&D Center 3.5cm Aktif Investment Bank Inc. 3.5cm Istanbul, Turkey 3.5cm 0.25cm Department of Computer Engineering 0.25cm Yildiz Technical University 0.25cm Istanbul, Turkey 0.25cm

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出一种异步流水线并行的Transformer框架,用于实时多语言唇同步,通过模块化设计和优化技术提升处理速度与资源利用率。

Comments Accepted to IEEE Big Data 2025, AIDE4IoT Workshop. Copyright \c{opyright} 2025 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18126 2025-12-23 cs.AI cs.MA 57%

Efficient Mixture-of-Agents Serving via Tree-Structured Routing, Adaptive Pruning, and Dependency-Aware Prefill-Decode Overlap

通过树状路由、自适应剪枝和依赖感知的预填解码重叠实现高效的混合代理服务

Zijun Wang, Yijiahao Qi, Hanqiu Chen, Zishen Wan, Gongjin Sun, Dongyang Li, Shuyi Pei, Cong Hao

机构 * Georgia Institute of Technology(佐治亚理工学院) Peking University(北京大学) Samsung Semiconductors, Inc.(三星半导体公司)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 本文提出一种高效的混合代理服务方法,通过树状路由、自适应剪枝和依赖感知的预填解码重叠,显著降低推理延迟并保持准确性。

Comments 13 pages, 4 figures, submitted to Design Automation Conference (DAC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18125 2025-12-23 quant-ph cs.LG 57%

Exploring polymer classification with a hybrid single-photon quantum approach

探索聚合物分类的混合单光子量子方法

Alexandrina Stoyanova, Bogdan Penkovsky

机构 * Alysophil 850 Bd Sébastien Brant, 67400 Illkirch-Graffenstaden, France(法国伊尔克希茨-格拉芬斯塔登市Alysophil 850 Bd Sébastien Brant)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出了一种混合经典-量子方法,利用单光子量子计算对聚合物进行分类,展示了在NISQ设备限制下有效处理化学分类任务的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08713 2025-12-23 cs.AI cs.DL 57%

The More You Automate, the Less You See: Hidden Pitfalls of AI Scientist Systems

自动化越多,看到的越少:人工智能科学家系统的隐藏陷阱

Ziming Luo, Atoosa Kasirzadeh, Nihar B. Shah

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文探讨了人工智能科学家系统中潜在的故障模式,指出其内部工作流程未被深入研究,通过实验揭示了四种风险,并建议要求提交跟踪日志和代码以提高透明度和可重复性。

Comments NeurIPS 2025 AI4Science (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00767 2025-12-23 cs.CV 50%

InterPose: Learning to Generate Human-Object Interactions from Large-Scale Web Videos

InterPose:从大规模网络视频中学习生成人-物体交互

Yangsong Zhang, Abdul Ahad Butt, Gül Varol, Ivan Laptev

专题命中 工作流自动化 :agent(abstract)

AI总结 InterPose通过大规模网络视频自动提取人-物体交互动作数据,提升人类动作生成的精度和多样性,同时开发LLM代理实现零样本动画生成。

Comments Accepted to 3DV 2026. Project page: https://mael-zys.github.io/InterPose/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18653 2025-12-23 cond-mat.mtrl-sci 50%

Tackling dataset curation challenges towards reliable machine learning: a case study on thermoelectric materials

应对数据集整理挑战以实现可靠的机器学习:热电材料的案例研究

Shoeb Athar, Adrien Mecibah, Philippe Jund

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文提出了一种基于统计轮换误差的数据过滤方法,用于解决热电材料数据集中的不准确性和不一致性问题,并通过混合数据集创建流程提升数据质量。

Comments 10 pages, 9 figures

Journal ref Mater. Today Phys. 59, 101948 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18627 2025-12-23 stat.ME econ.EM stat.CO 50%

Accuracy of Uniform Inference on Fine Grid Points

对细网格点的均匀推断精度

Shunsuke Imai

专题命中 工作流自动化 :workflow(abstract)

AI总结 本文研究了在有限网格点上使用乘数自助法实现有效均匀置信带所需的网格细度,并推导了覆盖误差的显式界限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18016 2025-12-23 physics.soc-ph math.CO 50%

Equivalent bounded confidence processes

有界置信度过程等价性

Sascha Kurz

专题命中 工作流自动化 :agent(abstract)

AI总结 研究有界置信度过程的等价性,通过起始配置和阈值划分,实现对小规模代理群体的精确现象分析。

Comments 33 pages, 2 tables, 9 figure; comments more than welcome

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 软件智能体 3 篇

2512.10713 2025-12-23 cs.SE cs.AI 62%

PACIFIC: a framework for generating benchmarks to check Precise Automatically Checked Instruction Following In Code

PACIFIC:用于检查精确自动指令遵循的代码基准生成框架

Itay Dreyfuss, Antonio Abu Nassar, Samuel Ackerman, Axel Ben David, Eitan Farchi, Rami Katan, Orna Raz, Marcel Zalmanovici

机构 * IBM Research(IBM研究)

专题命中 软件智能体 :agentic(abstract);分类 cs.AI、cs.SE

AI总结 PACIFIC框架通过生成具有明确预期输出的基准,评估LLM在代码指令遵循和dry运行能力上的表现,提供了一种抗污染且可扩展的评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14757 2025-12-23 cs.SE cs.AI 62%

SWE-Synth: Synthesizing Verifiable Bug-Fix Data to Enable Large Language Models in Resolving Real-World Bugs

SWE-Synth:合成可验证的bug修复数据以使大语言模型能够解决现实中的bug

Minh V. T. Pham, Huy N. Phan, Hoang N. Phan, Cuong Le Chi, Tien N. Nguyen, Nghi D. Q. Bui

机构 * FPT Software AI Center, Viet Nam(越南FPT软件AI中心) Nanyang Technological University, Singapore(新加坡南洋理工大学) University of Texas at Dallas, US(美国德克萨斯大学达拉斯分校)

专题命中 软件智能体 :agent(abstract);分类 cs.AI、cs.SE

AI总结 SWE-Synth通过合成可验证的bug修复数据集,提升大语言模型在解决现实bug中的性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.11068 2025-12-23 cs.LG cs.DC cs.SE 62%

A Reinforcement Learning Environment for Automatic Code Optimization in the MLIR Compiler

为MLIR编译器自动代码优化设计的一种强化学习环境

Mohammed Tirichine, Nassim Ameur, Nazim Bendib, Iheb Nassim Aouadj, Bouchama Djad, Rafik Bouloudene, Riyadh Baghdadi

机构 * New York University Abu Dhabi(纽约大学阿布扎赫尔分校) ESI(埃斯国际研究所) USTHB(阿尔及利亚国家技术与高等理工学院)

专题命中 软件智能体 :agent(abstract);分类 cs.LG、cs.SE

AI总结 本文提出MLIR RL,一种为MLIR编译器设计的强化学习环境,用于自动代码优化,通过多离散动作空间和level pointers方法提升策略学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. GUI与网页智能体 6 篇

2410.15178 2025-12-23 cs.RO cs.AI cs.LG cs.SY eess.SY 73%

GUIDEd Agents: Enhancing Navigation Policies through Task-Specific Uncertainty Abstraction in Localization-Limited Environments

GUIDEd Agents: 通过在定位受限环境中任务特定的不确定性抽象增强导航策略

Gokul Puthumanaillam, Paulo Padrao, Jose Fuentes, Leonardo Bobadilla, Melkior Ornik

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Providence College(普罗维登斯学院) Florida International University(佛罗里达国际大学)

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 GUIDE通过任务特定不确定性抽象提升机器人在定位受限环境中的导航策略,实现任务完成与不确定性管理的平衡。

Comments Accepted for publication at RAL (Robotics and automation letters). Updated with the final version

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10101 2025-12-23 cs.RO 71%

Agile and Safe Trajectory Planning for Quadruped Navigation with Motion Anisotropy Awareness

具备运动各向异性意识的四足机器人导航轨迹规划

Wentao Zhang, Shaohang Xu, Peiyuan Cai, Lijun Zhu

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology, China(华中科技大学人工智能与自动化学院)

专题命中 GUI与网页智能体 :planning(title)

AI总结 本文提出了一种考虑四足机器人运动各向异性的导航框架,通过轨迹生成与优化提升导航效率和安全性。

Comments 8 pages, 6 figures, submitted to 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19024 2025-12-23 cs.RO cs.AI 70%

IndoorUAV: Benchmarking Vision-Language UAV Navigation in Continuous Indoor Environments

IndoorUAV:在连续室内环境中进行视觉-语言无人机导航的基准测试

Xu Liu, Yu Liu, Hanshuo Qiu, Yang Qirong, Zhouhui Lian

专题命中 GUI与网页智能体 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 IndoorUAV通过构建室内无人机视觉-语言导航基准,结合多模态推理和任务分解,为长视距和短视距导航提供高质量数据与模型支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19107 2025-12-23 cs.AI 57%

FC-MIR: A Mobile Screen Awareness Framework for Intent-Aware Recommendation based on Frame-Compressed Multimodal Trajectory Reasoning

FC-MIR:一种基于帧压缩多模态轨迹推理的移动屏幕感知框架,用于意图感知推荐

Zhe Yang, Xiaoshuang Sheng, Zhengnan Zhang, Jidong Wu, Zexing Wang, Xin He, Shenghua Xu, Guanjing Xiong

机构 * vivo AI Lab(vivo人工智能实验室) Zhejiang University(浙江大学)

专题命中 GUI与网页智能体 :agent(abstract);分类 cs.AI

AI总结 FC-MIR框架通过帧压缩多模态轨迹推理,提升移动设备上意图感知推荐的效率与实用性,支持轻量级部署并探索生成操作与建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00162 2025-12-23 cs.LG cs.NA math.NA 57%

Modeling Large-Scale Walking and Cycling Networks: A Machine Learning Approach Using Mobile Phone and Crowdsourced Data

对大规模步行和骑行网络建模:一种利用移动电话和众包数据的机器学习方法

Meead Saberi, Tanapon Lilasathapornkit

专题命中 GUI与网页智能体 :planning(abstract);分类 cs.LG

AI总结 本研究采用机器学习方法,利用移动电话和众包数据对澳大利亚新南威尔士州大规模步行和骑行网络进行建模,以提高主动交通规划的准确性。

Comments 22 pages, 8 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏