arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-11-21 至 2025-11-21 共收录 75 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 5 篇

2506.06017 2025-11-21 cs.CL 89%

AgentSwift: Efficient LLM Agent Design via Value-guided Hierarchical Search

AgentSwift: 通过价值引导的分层搜索高效设计LLM代理

Yu Li, Lehui Li, Zhihao Wu, Qingmin Liao, Jianye Hao, Kun Shao, Fengli Xu, Yong Li

专题命中 工具调用 :agent(title,abstract);tool use(abstract);planning(abstract);workflow(abstract)

AI总结 AgentSwift通过价值引导的分层搜索高效设计LLM代理,实现8.34%的性能提升。

Comments AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16278 2025-11-21 cs.CR cs.AI 57%

"To Survive, I Must Defect": Jailbreaking LLMs via the Game-Theory Scenarios

为生存,我必须背叛:通过博弈论场景进行大语言模型的劫持攻击

Zhen Sun, Zongmin Zhang, Deqi Liang, Han Sun, Yule Liu, Yun Shen, Xiangshan Gao, Yilong Yang, Shuai Liu, Yutao Yue, Xinlei He

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) East China Normal University(华东师范大学) Flexera(Flexera公司) Zhejiang University(浙江大学) Xidian University(西安电子科技大学) Xi’an Jiaotong University(西安交通大学) Institute of Deep Perception Technology, JITRI(JITRI深度感知技术研究所)

专题命中 工具调用 :agent(abstract);分类 cs.AI

AI总结 本文提出一种基于博弈论的可扩展黑盒劫持框架GTA,通过重塑LLM目标以提高攻击成功率,实现在多种场景下的高ASR表现。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07508 2025-11-21 cs.RO 50%

Non-Gaited Legged Locomotion with Monte-Carlo Tree Search and Supervised Learning

非步态化腿式运动与蒙特卡洛树搜索及监督学习

Ilyass Taouil, Lorenzo Amatucci, Majid Khadiv, Angela Dai, Victor Barasuol, Giulio Turrisi, Claudio Semini

机构 * Dynamic Legged Systems Laboratory, Istituto Italiano di Tecnologia (IIT), Genova, Italy(动态腿系统实验室,意大利技术研究院(IIT),意大利热那亚) D AI Laboratory, Technical University of Munich (TUM), Germany(3D人工智能实验室,慕尼黑技术大学(TUM),德国) ATARI Laboratory, MIRMI, Technical University of Munich (TUM), Germany(ATARI实验室,MIRMI,慕尼黑技术大学(TUM),德国)

专题命中 工具调用 :planning(abstract)

AI总结 本研究通过结合蒙特卡洛树搜索和监督学习,提出了一种适用于实时应用的非步态化腿式运动优化方法,通过学习最优价值函数加速步态规划并在仿真和硬件上验证其性能。

Journal ref IEEE Robotics and Automation Letters, 2025, vol. 10, no. 2, pp. 1265-1272

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16059 2025-11-21 cond-mat.mtrl-sci 50%

Extending SLUSCHI for Automated Diffusion Calculations

扩展SLUSCHI用于自动化扩散计算

Qi-Jun Hong, Qing Chen, Ligen Wang, Dallin Fisher, Audrey CampBell, Si-Da Xue, Linqin Mu, Noemi Leick, Seetharaman Sridhar

专题命中 工具调用 :workflow(abstract)

AI总结 扩展SLUSCHI用于自动化基于第一性原理分子动力学的扩散计算,通过改进的工作流和后处理工具,实现对金属和氧化物中扩散系数和粘度的高通量评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15995 2025-11-21 cs.RO 50%

PushingBots: Collaborative Pushing via Neural Accelerated Combinatorial Hybrid Optimization

PushingBots: 通过神经加速的组合混合优化实现协作推搡

Zili Tang, Ying Zhang, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(先进制造与机器人学院,北京大学)

专题命中 工具调用 :planning(abstract)

AI总结 PushingBots通过神经加速的组合混合优化实现机器人协作推搡,解决复杂环境中多物体精准推运问题。

Comments 20 pages, 24 figures. Accepted to IEEE Transactions on Robotics (T-RO), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 27 篇

2511.16635 2025-11-21 cs.CV cs.CL 89%

SurvAgent: Hierarchical CoT-Enhanced Case Banking and Dichotomy-Based Multi-Agent System for Multimodal Survival Prediction

SurvAgent: 基于层次化CoT增强的案例库与二元多智能体系统用于多模态生存预测

Guolin Huang, Wenting Chen, Jiaqi Yang, Xinheng Lyu, Xiaoling Luo, Sen Yang, Xiaohan Xing, Linlin Shen

机构 * Shenzhen University(深圳大学) Stanford University(斯坦福大学) University of Nottingham Ningbo China(诺丁汉大学宁波分校) Ant Group(蚂蚁集团)

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract);planning(abstract);分类 cs.CL

AI总结 SurvAgent通过层次化CoT增强的多智能体系统,整合多模态数据,提升生存预测的可解释性与准确性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15712 2025-11-21 cs.CR cs.AI cs.DC 88%

Secure Autonomous Agent Payments: Verifying Authenticity and Intent in a Trustless Environment

安全的自主代理支付:在无信任环境中验证真实性和意图

Vivek Acharya

机构 * Vivek Acharya(独立研究者)

专题命中 规划决策 :agent(title,abstract);autonomous agent(title,abstract);分类 cs.AI

AI总结 本文提出基于区块链的框架,通过密码学认证和零知识证明,实现自主代理支付中的意图验证和身份认证,确保交易安全性和可追溯性。

Comments 6 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07686 2025-11-21 cs.RO 85%

Risk Map As Middleware: Towards Interpretable Cooperative End-to-end Autonomous Driving for Risk-Aware Planning

风险地图作为中间件:迈向风险感知的可解释协作端到端自动驾驶

Mingyue Lei, Zewei Zhou, Hongchen Li, Jiaqi Ma, Jia Hu

机构 * Key Laboratory of Road and Traffic Engineering of the Ministry of Education, Tongji University(教育部道路与交通工程重点实验室,同济大学) UCLA Mobility Lab, University of California, Los Angeles(加州大学洛杉矶分校UCLA移动实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出RiskMM框架,通过风险地图中间件提升自动驾驶的可解释性和风险感知规划能力。

Comments IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05577 2025-11-21 cs.LG cs.AI cs.MA 84%

Policy Search, Retrieval, and Composition via Task Similarity in Collaborative Agentic Systems

通过任务相似性在协作代理系统中进行策略搜索、检索与组合

Saptarshi Nath, Christos Peridis, Eseoghene Benjamin, Xinran Liu, Soheil Kolouri, Peter Kinnell, Zexin Li, Cong Liu, Shirin Dora, Andrea Soltoggio

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出MOSAIC算法,通过任务相似性实现代理间的知识共享与策略组合,提升集体学习效率与任务解决能力。

Comments 24 pages, 20 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14210 2025-11-21 cs.CV cs.AI cs.LG 84%

Orion: A Unified Visual Agent for Multimodal Perception, Advanced Visual Reasoning and Execution

Orion:一个多模态感知、高级视觉推理与执行的统一视觉代理

N Dinesh Reddy, Dylan Snyder, Lona Kiragu, Mirajul Mohin, Shahrear Bin Amin, Sudeep Pillai

机构 * VLM Run Research(VLM Run研究)

专题命中 规划决策 :agent(title,abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 Orion通过整合视觉推理与工具增强执行,实现了多模态感知、高级视觉推理与执行的统一,提升多步骤视觉智能性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16402 2025-11-21 cs.AI cs.DB 84%

Trustworthy AI in the Agentic Lakehouse: from Concurrency to Governance

可信AI在代理湖仓中的实现:从并发到治理

Jacopo Tagliabue, Federico Bianchi, Ciro Greco

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 本文提出Bauplan设计,通过事务机制实现湖仓中的数据和计算隔离,解决代理工作流的可信性问题,并提供自修复管道的实现。

Comments AAAI26, pre-print of paper accepted at the Trustworthy Agentic AI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16292 2025-11-21 cs.AI 83%

Distributed Agent Reasoning Across Independent Systems With Strict Data Locality

跨独立系统的分布式代理推理与严格数据本地性

Daniel Vaughan, Kateřina Vaughan

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出了一种基于自然语言消息的分布式代理推理系统,通过伪匿名令牌和本地数据查询实现跨组织安全合作,验证了去中心化多代理系统的可行性。

Comments 27 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16243 2025-11-21 cs.CY 82%

An Agent-Based Simulation of Regularity-Driven Student Attrition: How Institutional Time-to-Live Constraints Create a Dropout Trap in Higher Education

基于常规驱动的学生流失的代理模拟:机构时间到寿命限制如何在高等教育中创造辍学陷阱

H. R. Paz

专题命中 规划决策 :agent(title,abstract);planning(abstract)

AI总结 本文通过代理模拟揭示了行政时间限制如何导致学生辍学,指出规范机制比单纯学术失败更驱动辍学,挑战了行政结构的中立性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15715 2025-11-21 cs.AI cs.LG 81%

Graph-Memoized Reasoning: Foundations Structured Workflow Reuse in Intelligent Systems

图记忆推理:智能系统中结构化工作流重用的基础

Yash Raj Singh

机构 * Independent Researcher(独立研究者)

专题命中 规划决策 :workflow(title);agentic(abstract);分类 cs.AI、cs.LG

AI总结 图记忆推理通过图结构内存实现推理工作流的重用,旨在提升智能系统中的效率与可重复性。

Comments 5 Pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16333 2025-11-21 cs.LG 79%

Beyond Generative AI: World Models for Clinical Prediction, Counterfactuals, and Planning

超越生成式AI:用于临床预测、反事实和规划的世界模型

Mohammad Areeb Qazi, Maryam Nadeem, Mohammad Yaqub

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫莫德·本·扎伊德人工智能大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文探讨了世界模型在医疗领域中的应用,旨在通过预测动态、反事实评估和规划提升临床决策的可靠性。

Comments 2 Figures, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08546 2025-11-21 cs.RO 78%

Grounding LLMs For Robot Task Planning Using Closed-loop State Feedback

通过闭环状态反馈接地LLMs用于机器人任务规划

Vineet Bhat, Ali Umut Kaypak, Prashanth Krishnamurthy, Ramesh Karri, Farshad Khorrami

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出BrainBody-LLM方法,通过闭环反馈机制提升LLMs在机器人任务规划中的鲁棒性,实现在复杂任务中的显著性能提升。

Comments Preprint version. Accepted full paper available here: https://advanced.onlinelibrary.wiley.com/doi/10.1002/adrr.202500072

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15752 2025-11-21 cs.AI cs.MA 77%

Build AI Assistants using Large Language Models and Agents to Enhance the Engineering Education of Biomechanics

利用大型语言模型和智能体构建AI助教以增强生物力学工程教育

Hanzhi Yan, Qin Lu, Xianqiao Wang, Xiaoming Zhai, Tianming Liu, He Li

专题命中 规划决策 :agent(abstract);AI agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 本文提出利用RAG和MAS提升LLM在生物力学教育中的表现,通过双模块框架增强教学效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16080 2025-11-21 cs.PL cs.AI cs.LG 73%

Operon: Incremental Construction of Ragged Data via Named Dimensions

Operon:通过命名维度逐步构建不规则数据

Sungbin Moon, Jiho Park, Suyoung Hwang, Donghyun Koh, Seunghyun Moon, Minhyeong Lee

专题命中 规划决策 :AI agent(abstract);workflow(abstract);分类 cs.AI、cs.LG

AI总结 Operon通过命名维度形式化方法,实现对不规则数据的逐步构建,提升大规模数据处理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02054 2025-11-21 cs.RO cs.AI cs.CV cs.LG 73%

RAPID: Robust and Agile Planner Using Inverse Reinforcement Learning for Vision-Based Drone Navigation

RAPID: 基于逆强化学习的鲁棒且敏捷规划器用于基于视觉的无人机导航

Minwoo Kim, Geunsik Bae, Jinwoo Lee, Woojae Shin, Changseung Kim, Myong-Yol Choi, Heejung Shin, Hyondong Oh

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于逆强化学习的无人机高速视觉导航规划器,通过减少环境交互和提升鲁棒性,实现复杂环境中的敏捷飞行。

Comments 18 pages, 11 figures, 58 references, and appendix is included

Journal ref Proceedings of Robotics: Science and Systems (RSS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16043 2025-11-21 cs.LG 70%

Agent0: Unleashing Self-Evolving Agents from Zero Data via Tool-Integrated Reasoning

Agent0: 通过工具集成推理从零数据中释放自进化代理

Peng Xia, Kaide Zeng, Jiaqi Liu, Can Qin, Fang Wu, Yiyang Zhou, Caiming Xiong, Huaxiu Yao

机构 * Stanford University(斯坦福大学) Salesforce Research(Salesforce研究院)

专题命中 规划决策 :agent(abstract);tool use(abstract);分类 cs.LG

AI总结 Agent0通过多步骤共进化和工具集成,在无需外部数据的情况下自主提升代理性能,显著增强推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16671 2025-11-21 cs.CV cs.AI cs.CL 62%

Thinking-while-Generating: Interleaving Textual Reasoning throughout Visual Generation

生成中思考:在视觉生成过程中穿插文本推理

Ziyu Guo, Renrui Zhang, Hongyu Li, Manyuan Zhang, Xinyan Chen, Sifan Wang, Yan Feng, Peng Pei, Pheng-Ann Heng

机构 * CUHK(香港中文大学) IMIXR MMLab Meituan Project(美团项目)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文提出TwiG框架,通过在视觉生成过程中穿插文本推理,提升生成内容的上下文感知和语义丰富性。

Comments Project Page: https://think-while-gen.github.io Code: https://github.com/ZiyuGuo99/Thinking-while-Generating

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12115 2025-11-21 cs.CL cs.AI 62%

Eliciting Reasoning in Language Models with Cognitive Tools

通过认知工具激发语言模型的推理能力

Brown Ebouky, Andrea Bartezzaghi, Mattia Rigotti

机构 * IBM Research - Zurich(IBM瑞士研究中心) ETH Zurich(苏黎世联邦理工学院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 通过引入认知工具,提升语言模型在数学推理任务上的性能,探索推理机制并补充训练后方法的作用。

Comments 25 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16248 2025-11-21 cs.AI 57%

Revisiting Fairness-aware Interactive Recommendation: Item Lifecycle as a Control Knob

重新审视公平性意识的交互推荐:项目生命周期作为控制变量

Yun Lu, Xiaoyu Shi, Hong Xie, Chongjun Xia, Zhenhui Gong, Mingsheng Shang

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出LHRL框架,通过生命周期意识协调公平性与准确性,提升交互推荐系统的公平性和用户参与度。

Comments 8 pages, 5 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06190 2025-11-21 cs.CL 57%

Confidence-Guided Stepwise Model Routing for Cost-Efficient Reasoning

基于置信度的分步模型路由用于高效推理

Sangmook Lee, Dohyung Kim, Hyukhun Koh, Nakyeong Yang, Kyomin Jung

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 STEER通过利用模型内部置信度实现高效的模型路由,减少推理成本并提升准确性。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04988 2025-11-21 cs.LG 57%

A Hybrid Deep Learning based Carbon Price Forecasting Framework with Structural Breakpoints Detection and Signal Denoising

一种基于深度学习的碳价预测框架,结合结构突变检测与信号去噪

Runsheng Ren, Jing Li, Yanxiu Li, Shixun Huang, Jun Shen, Wanqing Li, John Le, Sheng Wang

机构 * School of Computing and Information Technology, University of Wollongong, Wollongong, Australia(计算机与信息科技学院,沃林根大学,澳大利亚沃林根) School of Computer Science, Wuhan University, Wuhan, China(计算机科学学院,武汉大学,中国武汉)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一种结合结构突变检测与信号去噪的深度学习框架,通过整合LSTM、GRU和TCN模型,提升碳价预测的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16498 2025-11-21 cs.CV 50%

Acquisition Time-Informed Breast Tumor Segmentation from Dynamic Contrast-Enhanced MRI

基于动态对比增强MRI的肿瘤分割:考虑成像时间

Rui Wang, Yuexi Du, John Lewin, R. Todd Constable, Nicha C. Dvornek

机构 * Yale University(耶鲁大学)

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种利用成像时间信息提升乳腺DCE-MRI肿瘤分割性能的方法,通过FiLM层调节模型特征,提高分割精度和泛化能力。

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16303 2025-11-21 quant-ph 50%

ATLAS: Efficient Atom Rearrangement for Defect-Free Neutral-Atom Quantum Arrays Under Transport Loss

ATLAS:高效原子重排用于在传输损失下无缺陷的中性原子量子阵列

Otto Savola, Alexandru Paler

专题命中 规划决策 :planning(abstract)

AI总结 ATLAS通过高效原子重排算法在考虑传输损失的条件下实现无缺陷中性原子量子阵列的高填充率和高保留率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16063 2025-11-21 cs.NI 50%

Modeling Pointing, Acquisition, and Tracking Delays in Free-Space Optical Satellite Networks

自由空间光学卫星网络中指针、获取和跟踪延迟的建模

Jason Gerard, Juan A. Fraire, Sandra Céspedes

专题命中 规划决策 :planning(abstract)

AI总结 本文提出了一种用于自由空间光学卫星网络中指针、获取和跟踪延迟建模的验证模型,以提高接触计划的准确性和网络利用率。

Comments 2025 IEEE International Conference on Wireless for Space and Extreme Environments (WiSEE) - STINT Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16044 2025-11-21 cs.DS cs.GT 50%

Robustness of Online Inventory Balancing to Inventory Shocks

在线库存平衡对库存冲击的鲁棒性

Yiding Feng, Rad Niazadeh, Amin Saberi

专题命中 规划决策 :planning(abstract)

AI总结 本文提出分批库存平衡算法,以应对库存冲击,证明其在非单调库存波动下的鲁棒性,改进了传统库存平衡策略的竞争力比率。

Comments Preliminary version in the Web and Internet Economics (WINE 2025) conference; Journal version in Operations Research (major revision)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15932 2025-11-21 q-bio.QM 50%

How Mathematical Forms of Chemotherapy and Radiotherapy Bias Model-Optimized Predictions: Implications for Model Selection

数学化疗和放疗形式如何偏指导模型优化预测:对模型选择的影响

Changin Oh, Kathleen P. Wilkie

专题命中 规划决策 :planning(abstract)

AI总结 本研究探讨了数学模型选择对化疗和放疗优化预测的影响,强调在不确定性量化中需全面分析模型偏见和参数可识别性,以提高预测的稳健性和可推广性。

Comments 38 pages, 15 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏