arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-19 至 2025-12-19 共收录 84 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 17 篇

2504.10506 2025-12-19 cs.SI 50%

WorldMove, a global open data for human mobility

WorldMove,一个全球开放的人类移动数据集

Yuan Yuan, Yuheng Zhang, Jingtao Ding, Yong Li

专题命中 工作流自动化 :planning(abstract)

AI总结 WorldMove通过基于扩散的生成模型,生成全球1600多个城市的高质量合成移动数据,填补数据缺口并支持隐私保护的移动研究。

Comments Accepted by Scientific Data

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 软件智能体 3 篇

2511.12998 2025-12-19 cs.CV 78%

PerTouch: VLM-Driven Agent for Personalized and Semantic Image Retouching

PerTouch:基于VLM的个性化和语义图像润色代理

Zewei Chang, Zheng-Peng Duan, Jianxing Zhang, Chun-Le Guo, Siyu Liu, Hyungju Chun, Hyunhee Park, Zikun Liu, Chongyi Li

专题命中 软件智能体 :agent(title,abstract)

AI总结 PerTouch通过VLM驱动代理实现个性化和语义图像润色,结合语义替换与参数扰动机制,提升用户意图匹配与长期偏好捕捉能力。

Comments To appear at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16262 2025-12-19 cs.AI 70%

Learning to Wait: Synchronizing Agents with the Physical World

学习等待:与物理世界同步智能体

Yifei She, Ping Zhang, He Liu, Yanmin Jia, Yang Jing, Zijun Liu, Peng Sun, Xiangbin Li, Xiaohe Hu

机构 * Infrawaves Shanghai Qiji Zhifeng Co., Ltd.(上海启智风有限公司) Tsinghua University(清华大学)

专题命中 软件智能体 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出了一种智能体侧方法,使大语言模型通过预测等待时间实现与物理世界的同步,解决了异步环境中动作延迟的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
1906.06890 2025-12-19 cs.LG stat.ML 57%

Learning-Driven Exploration for Reinforcement Learning

基于学习的探索用于强化学习

Muhammad Usama, Dong Eui Chang

专题命中 软件智能体 :agent(abstract);分类 cs.LG

AI总结 本文提出基于熵的探索方法,通过自适应探索状态空间未探索区域,提升强化学习的效率和学习速度。

Journal ref 2021 21st International Conference on Control, Automation and Systems (ICCAS)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. GUI与网页智能体 1 篇

2512.16067 2025-12-19 cs.HC 50%

WING: An Adaptive and Gamified Mobile Learning Platform for Neurodivergent Literacy

WING:一种适应性且游戏化的移动学习平台,用于神经多样性阅读能力发展

Mirella Emily Bezerra Santana, Cauã Otaviano Jordão, Victor Barbosa dos Santos, Leonardo José Oliveira Ibiapina, Gabriel Moraes da Silva, Marina Robalinho Cavalcanti, Lucas Rodolfo Celestino Farias

专题命中 GUI与网页智能体 :planning(abstract)

AI总结 WING是一款针对神经多样性儿童阅读能力发展的适应性游戏化移动学习平台,结合多感官设计和自适应学习路径,通过互动环境提升学习参与度和自主性。

Comments 13 pages, multiple figures, Human-Computer Interaction and inclusive educational technology preprint, in Portuguese language

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 记忆与上下文管理 6 篇

2506.13324 2025-12-19 cs.AI cs.MA 85%

Towards Pervasive Distributed Agentic Generative AI -- A State of The Art

迈向普及型分布式代理生成AI——综述

Gianni Molinari, Fabio Ciravegna

机构 * University of Turin(都灵大学)

专题命中 记忆与上下文管理 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文综述了智能代理和大语言模型在普及计算中的最新发展,探讨了代理部署策略、挑战及提出的‘代理作为工具’框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16532 2025-12-19 cs.AI cs.IR 83%

From Personalization to Prejudice: Bias and Discrimination in Memory-Enhanced AI Agents for Recruitment

从个性化到偏见:记忆增强型AI招聘代理中的偏见与歧视

Himanshu Gharat, Himanshi Agrawal, Gourab K. Patro

机构 * Phi Labs, Quantiphi Inc.(Phi实验室、Quantiphi公司)

专题命中 记忆与上下文管理 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 研究揭示了记忆增强型AI招聘代理中偏见的系统性引入与强化,强调了对LLM基础AI代理的额外防护措施的必要性。

Comments In Proceedings of the Nineteenth ACM International Conference on Web Search and Data Mining (WSDM '26)

Journal ref In Proceedings of the Nineteenth ACM International Conference on Web Search and Data Mining (WSDM '26), 2026, Boise, ID, USA. ACM, New York, NY, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15813 2025-12-19 cs.SE cs.AI 79%

CodeMem: Architecting Reproducible Agents via Dynamic MCP and Procedural Memory

CodeMem: 通过动态MCP和程序记忆构建可重复的智能体

Nishant Gaurav, Adit Akarsh, Tejas Ravishankar, Manoj Bajaj

专题命中 记忆与上下文管理 :agent(abstract);AI agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 CodeMem通过动态MCP和程序记忆架构,解决智能体在重复任务中的概率不稳定性问题,实现可靠的工作流构建与运行。

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16202 2025-12-19 cs.CV cs.AI 57%

Open Ad-hoc Categorization with Contextualized Feature Learning

开放性即需分类与上下文化特征学习

Zilin Wang, Sangwoo Mo, Stella X. Yu, Sima Behpour, Liu Ren

机构 * University of Michigan(密歇根大学) UC Berkeley(加州大学伯克利分校) Bosch Center for AI(博世人工智能中心)

专题命中 记忆与上下文管理 :AI agent(abstract);分类 cs.AI

AI总结 OAK通过引入上下文标记和结合CLIP与GCD目标,实现了开放性即需分类的高准确率和可解释性。

Comments 26 pages, 17 figures

Journal ref CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15740 2025-12-19 cs.AI math.OC 57%

The Principle of Proportional Duty: A Knowledge-Duty Framework for Ethical Equilibrium in Human and Artificial Systems

比例责任原则:一种用于人类和人工系统伦理平衡的知识-责任框架

Timothy Prescher

专题命中 记忆与上下文管理 :agent(abstract);分类 cs.AI

AI总结 本文提出比例责任原则,通过数学模型平衡认知自信与情境风险,为复杂系统中的伦理决策提供稳定框架。

Comments 46 pages, 2 figures. Preregistered at OSF on Nov 14, 2025 (https://doi.org/10.17605/OSF.IO/BMVP3). Includes comparative analysis with OpenAI's 'Confessions' paper (Dec 3, 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15854 2025-12-19 math.PR math.OC 50%

Control of McKean--Vlasov SDEs with Contagion Through Killing at a State-Dependent Intensity

通过状态依赖强度的杀灭控制含传染性的 McKean-Vlasov 随机微分方程

Ben Hambly, Philipp Jettkant

专题命中 记忆与上下文管理 :agent(abstract)

AI总结 本文研究了通过状态依赖强度的杀灭控制含传染性的 McKean-Vlasov 随机微分方程,证明了其作为有限粒子系统极限的理论贡献,并展示了其在金融系统中控制系统性风险的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. Agent评测 12 篇

2512.16108 2025-12-19 cs.AI 88%

WeMusic-Agent: Efficient Conversational Music Recommendation via Knowledge Internalization and Agentic Boundary Learning

WeMusic-Agent: 通过知识内化和代理边界学习实现高效的对话音乐推荐

Wendong Bi, Yirong Mao, Xianglong Liu, Kai Tian, Jian Zhang, Hanjie Wang, Wenhui Que

专题命中 Agent评测 :agent(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 WeMusic-Agent通过知识内化和代理边界学习,实现高效对话音乐推荐,提升个性化和多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16250 2025-12-19 cs.AI cs.MA 83%

AMUSE: Audio-Visual Benchmark and Alignment Framework for Agentic Multi-Speaker Understanding

AMUSE:面向代理多说话者理解的音频-视觉基准与对齐框架

Sanjoy Chowdhury, Karren D. Yang, Xudong Liu, Fartash Faghri, Pavan Kumar Anasosalu Vasu, Oncel Tuzel, Dinesh Manocha, Chun-Liang Li, Raviteja Vemulapalli

机构 * University of Maryland, College Park(马里兰大学学院公园分校) Apple(苹果公司)

专题命中 Agent评测 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 AMUSE提出一个面向多说话人理解的音频-视觉基准与对齐框架RAFT,通过代理推理提升多模态模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16381 2025-12-19 cs.NI 82%

A Network Arena for Benchmarking AI Agents on Network Troubleshooting

一个用于AI代理在网络故障排除中基准测试的网络竞技场

Zhihao Wang, Alessandro Cornacchia, Alessio Sacco, Franco Galante, Marco Canini, Dingde Jiang

专题命中 Agent评测 :AI agent(title);agent(abstract);agentic(abstract)

AI总结 NIKA是一个开源的网络故障排除基准,用于评估AI代理在动态网络环境中的性能,包含数百个精心挑选的网络事件和54个代表性问题,旨在帮助研究人员和网络专家改进网络故障诊断能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16408 2025-12-19 cs.LG cs.MA 79%

NDRL: Cotton Irrigation and Nitrogen Application with Nested Dual-Agent Reinforcement Learning

NDRL:基于嵌套双智能体强化学习的棉花灌溉与氮肥施用

Ruifeng Xu, Liang He

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) Xinjiang Multimodal Information Technology Engineering Research Center(新疆多模态信息处理工程技术研究中心) Xinjiang Key Laboratory of Signal Detection and Processing(新疆信号检测与处理重点实验室) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

专题命中 Agent评测 :agent(title,abstract);分类 cs.LG

AI总结 NDRL通过嵌套双智能体强化学习优化棉花灌溉与氮肥施用,提升产量和资源利用效率。

Comments Accepted by ICONIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15361 2025-12-19 cs.CE 78%

A Data-Enhanced Agent-Based Model for Simulating 3D Cancer Spheroid Growth: Integrating Metabolism and Mechanics

一种数据增强的基于代理的模型用于模拟3D肿瘤球体生长:整合代谢与力学

Pedro Garcia-Gomez, Paula Guerrero-Lopez, Silvia Hervas-Raluy, Jose Manuel Garcia-Aznar

专题命中 Agent评测 :agent(title,abstract)

AI总结 本文提出一种整合代谢与力学的基于代理的模型,用于模拟3D肿瘤球体生长,通过参数校准和实验验证,揭示了肿瘤生长的动态机制和细胞行为差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16530 2025-12-19 cs.CL cs.AI 73%

Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics

利用大语言模型对生物医学文本进行plain language改编:评估指标的比较

Primoz Kocbek, Leon Kopitar, Gregor Stiglic

专题命中 Agent评测 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 本研究比较了利用大语言模型对生物医学文本进行plain language改编的不同方法,发现gpt-4o-mini在评估指标上表现优异,而微调方法效果欠佳。

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16553 2025-12-19 cs.AI cs.CL 62%

Needle in the Web: A Benchmark for Retrieving Targeted Web Pages in the Wild

网络中的针:评估在真实世界中检索和推理网页的基准测试

Yumeng Wang, Tianyu Fan, Lingrui Xu, Chao Huang

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.CL

AI总结 Needle in the Web 是一个评估现代搜索代理和LLM在模糊探索性查询中检索和推理真实网页能力的基准测试,揭示了当前搜索系统在处理模糊性和复杂性时的挑战。

Comments Data and code are available at https://github.com/Tango-Whiskyman/Needle_in_the_Web

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15784 2025-12-19 cs.AI cs.LG 62%

Beyond Training: Enabling Self-Evolution of Agents with MOBIMEM

超越训练:通过MOBIMEM实现智能体的自我进化

Zibin Liu, Cheng Zhang, Xi Zhao, Yunfei Feng, Bingyu Bai, Dahu Feng, Erhu Feng, Yubin Xia, Haibo Chen

机构 * Institute of Parallel and Distributed Systems, Shanghai Jiao Tong University(并行与分布式系统研究所,上海交通大学)

专题命中 Agent评测 :agent(abstract);分类 cs.AI、cs.LG

AI总结 MOBIMEM通过引入内存原语和操作系统启发的服务,实现了无需模型重训练的智能体自我进化,显著提升了任务成功率和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16022 2025-12-19 cs.AI 57%

Conversational Time Series Foundation Models: Towards Explainable and Effective Forecasting

对话式时间序列基础模型:迈向可解释且有效的预测

Defu Cao, Michael Gee, Jinbo Liu, Hengxuan Wang, Wei Yang, Rui Wang, Yan Liu

机构 * University of Southern California(南加州大学) Amazon AWS(亚马逊AWS)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 本文提出了一种对话式时间序列基础模型,通过智能法官机制协调集成模型,提升预测的可解释性和效果。

Comments 31Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16887 2025-12-19 physics.soc-ph physics.comp-ph 50%

An evacuation simulator for pedestrian dynamics based on the Social Force Model

基于社交力模型的行人动态疏散模拟器

Julián López, Virginia Mazzone, M. Leticia Rubio Puzzo, Juan Cruz Moreno

专题命中 Agent评测 :planning(abstract)

AI总结 基于社交力模型的开源疏散模拟器,提供直观界面和模块化设计,用于分析行人动态和优化疏散规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16011 2025-12-19 cs.RO 50%

dLITE: Differentiable Lighting-Informed Trajectory Evaluation for On-Orbit Inspection

dLITE:可微分的光照感知轨道检查轨迹评估

Jack Naylor, Raghav Mishra, Nicholas H. Barbara, Donald G. Dansereau

机构 * Australian Centre for Robotics(澳大利亚机器人中心) School of Aerospace, Mechanical and Mechatronic Engineering, The University of Sydney(航空航天、机械与机电工程学院,悉尼大学) Asset Management Hub (ARIAM), The University of Sydney(资产管理工作中心(ARIAM),悉尼大学)

专题命中 Agent评测 :planning(abstract)

AI总结 dLITE是一种全新的可微分模拟流水线,用于优化轨道检查轨迹以提高图像质量,为航天器任务规划提供创新方法。

Comments 13 pages, 9 images

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00329 2025-12-19 cs.SI 50%

When Small Acts Scale: Ethical Thresholds in Network Diffusion

当小行为扩大:网络扩散中的伦理阈值

Masoud Makrehchi

专题命中 Agent评测 :agent(abstract)

AI总结 本文提出一个信息传递模型,研究网络扩散中的伦理阈值,揭示不同平台设计因素如何影响下游责任,应用于流行病防控和规范放大。

Comments 11 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他Agent 1 篇

2512.15732 2025-12-19 q-fin.TR cs.LG cs.NE q-fin.CP 57%

The Red Queen's Trap: Limits of Deep Evolution in High-Frequency Trading

红皇后陷阱:高频交易中深度进化局限性

Yijia Chen

机构 * Independent Researcher(独立研究者)

专题命中 其他Agent :autonomous agent(abstract);分类 cs.LG

AI总结 本文研究了高频交易中深度进化方法的局限性,发现模型复杂性增加在缺乏信息不对称时会加剧系统脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏