arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-08-19 至 2026-08-19 共收录 119 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 6 篇

2608.17275 2026-08-19 cs.CR cs.AI 新提交 77%

When Agents Act on Web3: An Attack-Surface Survey of MCP, Skills, and Tool Calling

当智能体在Web3中行动:MCP、技能与工具调用的攻击面调查

Rabimba Karanjai, Yang Lu, Nour Diallo, Wujie Xiong, Lei Xu, Weidong, Shi

专题命中 工具调用 :agent(abstract);AI agent(abstract);tool use(abstract);分类 cs.AI

AI总结 本调查针对智能体通过MCP等在Web3区块链上行动的攻击面,构建风险映射矩阵,发现现有防护不足,推导了相关研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17501 2026-08-19 cs.AI cs.LG 新提交 74%

SGHA: Evidence-Grounded Research Problem Discovery with Local Language Models

SGHA:基于证据的研究问题发现,使用本地语言模型

Sarvesh Gharat, Junpei Komiyama

机构 * C-MInDS, IIT Bombay(印度理工学院孟买分校C-MInDS) Machine Learning Department, MBZUAI(穆罕默德·本·扎耶德人工智能大学机器学习系)

专题命中 工具调用 :agent(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 该研究提出SGHA,一种基于本地9B开源LLM的研究问题发现系统,通过构建文献证据图检测研究差距,经对比实验证明其可实现可核查的研究问题构建,无需依赖专有前沿模型。

Comments Link to Code and artifacts: https://github.com/SarveshVGharat/structural-gap-hypothesis-agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17381 2026-08-19 q-bio.QM cs.AI cs.LG q-bio.BM 新提交 62%

Leveraging generative hallucination and biophysics-informed modeling for unified biomolecular sequence-structure co-design

利用生成式幻觉和生物物理引导建模实现统一的生物分子序列-结构协同设计

Xuefeng Liu, Mingxuan Cao, Xiao Luo, Songhao Jiang, Tobin Sosnick, Jinbo Xu, Louis Maher, Rick Stevens

专题命中 工具调用 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究针对DNA/RNA等生物分子设计难题,提出MCTH框架,通过蒙特卡洛树搜索实现序列-结构协同设计,在多模态设计任务中性能优于基线,且可跨模态泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17499 2026-08-19 cs.AI 新提交 57%

Towards Better Agents for Multi-Turn User Interaction: The Next User Turn Is More Than Context

面向更好的多轮用户交互智能体:下一轮用户输入不止是上下文

Yiwen Zhao, Zhihao Wen, Yuchen Mao, Mingxuan Jiang, Yihao Hu, Pan Wang, Xin Zhang, Wei Wu

机构 * Fudan University(复旦大学) Ant International, Ant Group(蚂蚁集团蚂蚁国际)

专题命中 工具调用 :tool use(abstract);分类 cs.AI

AI总结 该研究针对多轮用户交互智能体的信用分配问题,提出FACA方法,在多领域测试中提升了8B和14B规模模型的性能,验证了下一轮用户反应可提供局部信用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17446 2026-08-19 econ.TH 新提交 50%

Searchable Menus

可搜索菜单

Frank Yang, Piotr Dworczak

专题命中 工具调用 :agent(abstract)

AI总结 本文研究代理人视角下受可处理性约束的最优筛选机制,提出可搜索菜单要求,在多产品垄断等不同场景推导最优可搜索菜单形式,得出多维筛选中可搜索性限制可实施结果集合的结论。

Comments 83 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17889 2026-08-19 cs.IR 新提交 50%

VisDocAgentBench: Benchmarking Agents for Visually Rich Document Retrieval

VisDocAgentBench:面向视觉丰富文档检索的智能体基准测试

Lexiang Hu, Yanzhao Zhang, Mingxin Li, Dingkun Long, Yikang Li, Fuwei Zhang, Yisen Wang, Zhouchen Lin

专题命中 工具调用 :agentic(abstract)

AI总结 该研究提出VisDocAgentBench基准,对比静态与智能体检索,发现视觉检索优于OCR文本检索,智能体可改善双桥项检索性能,为检索智能体发展提供方向。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 33 篇

2608.17310 2026-08-19 cs.LG 新提交 90%

Agentic ESOpt: Fine-Tuning Long-Horizon LLM Agents with Minimal GPU Requirements

Agentic ESOpt:以最小GPU资源微调长视野大语言模型智能体

Zhi Zheng, Rongsheng Chen, Yunpeng Ba, Zhenkun Wang, Yee Whye Teh, Wee Sun Lee

机构 * National University of Singapore(新加坡国立大学)

专题命中 规划决策 :agentic(title,title_cn);分类 cs.LG

AI总结 本文提出Agentic ESOpt框架,用进化策略微调长视野LLM智能体,仅需最小GPU资源,在WebArena-Lite上使Qwen-3.5-27B性能提升6.69%,提示-参数协同演化在多数设置中优于基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17289 2026-08-19 cs.AI 新提交 88%

PlanPO: Group Planning-Aware Policy Optimization for Multi-Turn Agentic LLMs

PlanPO:面向多轮智能体大语言模型的组规划感知策略优化

Dayang Liang, Liyuan He, Xuan Feng, Shuxin Li, Bo An, Yunlong Liu

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 针对现有组相对策略优化无法区分成功轨迹效率差异的问题,提出 PlanPO 方法,引入由粗到细的优势信号,在三类多轮基准上较 GRPO 平均提升 27.2%,且训练成本可忽略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17932 2026-08-19 cs.MA cs.AI 新提交 85%

Collective Counterfactual Planning: Coordination, Consent, and Verification under Representational Constraints

集体反事实规划:表征约束下的协调、同意与验证

Chainarong Amornbunchornvej

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究提出集体反事实规划(CCP)形式化模型,分析表征约束下群体规划的可行性,揭示正负二元性,给出四步可解性方案,解释群体协作的几何机制。

Comments The code is available at https://github.com/DarkEyes/Coll-Counterfactual-Plan

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17282 2026-08-19 cs.AI 新提交 85%

DeAR: Decentralized Agentic Reasoning via Capability Grounding and Collaborative Thought Navigation

DeAR:基于能力锚定与协作思维导航的去中心化智能体推理

Xing Wei, Changmeng Zheng, XiaoYong Wei, Xiufen Ye, Qing Li

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对现有智能体推理系统的路由瓶颈与静态角色分配问题,提出DeAR框架,通过三种机制实现去中心化协作,在9类基准测试中性能优于基线方法,提升了知识密集型推理任务的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16891 2026-08-19 cs.AI cs.CE cs.CR cs.CY 新提交 85%

Runtime Governance for Agentic AI: Action-Boundary Control with Trusted Provenance and Fail-Closed Execution

智能体AI的运行时治理:基于可信溯源与故障闭锁执行的行动边界控制

Adam Mazzocchetti

机构 * SPQR Technologies Inc.(SPQR科技公司)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);workflow(abstract);分类 cs.AI

AI总结 该研究提出Aegis运行时治理系统,通过可信决策层调解智能体AI的工具行动提案,在沙堡语料库评估中成功阻止风险提案转化为治理副作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.18067 2026-08-19 cs.GT 新提交 85%

Planning Against Learning in Rank-1 Games

在秩-1博弈中针对学习的规划

William Overman

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 该研究针对满足$\text{rank}(A+B)=1$的双矩阵博弈,证明其纳什均衡可多项式时间计算,但针对学习动态的最优规划是NP困难的,区分了高效均衡计算与策略规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17834 2026-08-19 cs.HC cs.AI 新提交 83%

AdaLens: Interactive Storyline for Monitoring and Steering Long-Running Agentic Data Analysis

AdaLens:用于监控和引导长时间运行的智能体数据分析的交互式故事情节

Yangtian Liu, Yan Miao, Shuhan Liu, Yunfan Zhou, Dae Hyun Kim, Di Weng, Yingcai Wu

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.AI

AI总结 针对长时间智能体数据分析的传统界面无法满足可观测性与可引导性需求,本文提出交互式系统AdaLens,结合故事情节表示与引导交互,经案例及用户研究验证其能有效支持分析师监控与引导此类分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17220 2026-08-19 cs.CR cs.AI 新提交 83%

PACE: Policy-Attested Contract Execution for Safe AI Agents in Decentralized Finance

PACE:用于去中心化金融中安全AI智能体的策略验证合约执行

Rabimba Karanjai, Yang Lu, Richard Williamson, Hemanth Hm, Prakhar Mehrotra, Lei Xu, Weidong, Shi

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI

AI总结 该研究提出PACE框架,通过引入类型化交易意图等机制,实现去中心化金融中AI智能体的安全交易授权,在确定性沙箱中实现0.00不安全执行率和0.00误报率,提升了DeFi场景下AI智能体的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17279 2026-08-19 cs.CV 新提交 80%

Key-Frame Reasoning with SAM3: Third Place Solution for the MeViS-Text Track of the 8th LSVOS Challenge

基于SAM3的关键帧推理:第8届LSVOS挑战赛MeViS-Text赛道第三名解决方案

Ce Bian, Xusheng He, Jinrong Zhang, Canyang Wu, Xianjing Han, Jianlong Wu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Nanyang Technological University(南洋理工大学) Shenzhen Loop Area Institute(深圳河套学院)

专题命中 规划决策 :agent(summary_cn,abstract)

AI总结 该研究提出两阶段无训练方案,依托Gemini-3.1 Pro分解视频事件选关键帧,用SAM3-agent生成掩码并双向传播,获第8届LSVOS挑战赛MeViS-Text赛道第三名。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17324 2026-08-19 cs.RO 新提交 78%

Reconfiguration-Complete Motion Primitives with Constructive Planning for Deformable Planar Modular Robots

面向可变形平面模块化机器人的带构造性规划的可重构完备运动原语

Jie Gu, Tingting Wang, Hongrun Gao, Yirun Sun, Zhihao Xia, Chunxu Tian, Dan Zhang

机构 * Institute of AI and Robotics, Academy for Engineering & Technology, Fudan University(复旦大学工程与技术学院人工智能与机器人研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对可变形平面模块化机器人重构规划的固定表示难题,提出带构造性规划的运动原语及前瞻选择器,证明N≥7的边连接非直线构型可相互重构,实验显示规划时间短于现有框架。

Comments Jie Gu and Tingting Wang contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17172 2026-08-19 cs.NE 新提交 78%

Automating Parent Selection Configuration in Genetic Programming with Agentic AI

用智能体人工智能实现遗传编程中父代选择配置的自动化

Jose Guadalupe Hernandez, Jui-Hsuan Chang, Anil Kumar Saini, Xi Li, Jason H. Moore

专题命中 规划决策 :agentic(title,abstract)

AI总结 该研究提出智能体AI框架,结合LLM推理与RAG实现遗传编程父代选择配置自动化,经符号回归测试,5 mini--AR配置表现优于锦标赛选择,为进化系统自动化设计提供了新路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17038 2026-08-19 cs.RO 新提交 78%

Terrain-Aware Local Path Planning with Global DEM Data Integration for Autonomous UGV Navigation

面向自主无人地面车辆(UGV)导航的融合全球数字高程模型(DEM)数据的地形感知局部路径规划

Devender Singh, Issah Nazif Suleiman, Paul Mitten, Glenn Cutler, Vinicius Prado da Fonseca, Matthew Hamilton

机构 * Memorial University of Newfoundland(纽芬兰纪念大学) Compusult Ltd.(康普萨尔特有限公司)

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究针对UGV户外导航中全局地图与实时传感器反馈脱节的问题,提出融合DEM与LiDAR的混合路径规划框架,经仿真验证可提升障碍物规避率、降低平均坡度,为可靠自主导航提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17121 2026-08-19 math.OC 新提交 78%

Bounds for multi-horizon stochastic optimization with application to power generation and transmission expansion planning

多阶段随机优化的界及其在发电与输电扩展规划中的应用

Giovanni Micheli, V Varagapriya, Francesca Maggioni, Guzin Bayraksan

专题命中 规划决策 :planning(title,abstract)

AI总结 本文针对多阶段随机优化问题最优值界的计算难题,提出基于场景树分解的界估计技术,通过不同分解与重组策略实现高效求解,在发电与输电扩展规划问题中验证了方法的效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17133 2026-08-19 astro-ph.IM astro-ph.EP 新提交 78%

The Roman Coronagraph Community Participation Program: Observation planning and data reduction for polarimetric mode

罗曼日冕仪社区参与计划:偏振模式的观测规划与数据处理

Ramya M Anche, Toshiyuki Mizuki, Justin Hom, Alexis Lau, Saanika Choudhary, Jaren N. Ashcraft, Clarissa Do O, Tsutsumi Nagai, Sophie Noiret, Eric Shen, Taichi Uyama, Chen Xie, Jingwen Zhang, Vanessa P. Bailey, Eric Cady, Jessica Gersh-Range, Julien H. Girard, Guillermo Gonzalez, John Livingston, Bertrand Mennesson, Maxwell A. Millar-Blanchaer, Julia Milton, Naoshi Murakami, Dmitry Savransky, Motohide Tamura, Jason J. Wang, Schuyler G. Wolff, Marie Ygouf

专题命中 规划决策 :planning(title,abstract)

AI总结 该研究介绍罗曼日冕仪偏振模式的观测规划、模拟与数据处理流程,通过corgisim生成HD 172555的HLC模式偏振数据集,用corgidrp处理数据,为后续真实校准产品替换奠定基础。

Comments 11 pages, 8 figures, SPIE ATI 2026 (Copenhagen) conference proceeding

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17184 2026-08-19 cs.CL 新提交 70%

AISA: AI Safety Assistant Framework for Continuous Improvement of Highway Construction

AISA:用于公路施工持续改进的AI安全助手框架

Mason Smetana, Trevor Neece, Lev Khazanovich

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.CL

AI总结 本研究提出AISA框架,基于LLM和文本嵌入模型实现公路施工事故分类、质量评分及相关数据检索,为未来智能体应用提供基础,在OIICS分类和事故检索等任务上取得优于随机水平的效果。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17164 2026-08-19 cs.LG 新提交 70%

SCENARIODIFF: A Scenario-level Guidance Framework for Multimodal Time Series Forecasting--Extended Version

SCENARIODIFF:面向多模态时间序列预测的场景级引导框架——扩展版

Tuan-Binh Tran, Dat Nguyen Cong, Duc-Trong Le, Thanh Trung Huynh, Tung Kieu

机构 * VinUniversity FPT Software AI Center, FPT Corporation(FPT软件AI中心,FPT集团) VNU University of Engineering and Technology(VNU工程技术大学) Aalborg University(奥尔堡大学)

专题命中 规划决策 :agent(abstract,abstract_cn);分类 cs.LG

AI总结 该研究针对现有多模态时间序列预测方法上下文影响难解释控制的问题,提出SCENARIODIFF分层框架,通过三类智能体生成结构化信号引导多模态扩散Transformer,锚点混合采样优化轨迹,在Time-MMD基准的事件驱动领域表现优异。

Comments 10 pages. An extended version of "SCENARIODIFF: A Scenario-level Guidance Framework for Multimodal Time Series Forecasting" accepted at ICDM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17414 2026-08-19 cs.CV cs.PL 新提交 67%

REChart: Reasoning-Efficient Chart Editing with Large Reasoning Models

REChart:基于大型推理模型的推理高效图表编辑方法

Yuanbang Liu, Chenxi Ruan, Yihan Hou, Qiong Luo, Wei Zeng

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 规划决策 :workflow(abstract);agentic(abstract)

AI总结 REChart是两阶段训练框架,通过过程级监督提升图表编辑的保真度与推理效率,在两个基准上实现同规模开源模型最优性能,推理token用量降低79.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17146 2026-08-19 cs.RO 新提交 67%

PDDL-ART: Autonomous Symbolic Abstraction From Demonstration For Long-Horizon Robotic Manipulation Using Vision-Language Models

PDDL-ART:基于演示的自主符号抽象方法,用于使用视觉语言模型的长时程机器人操纵

Disha Kamale, Dmitry Berenson

机构 * University of Michigan(密歇根大学)

专题命中 规划决策 :tool-use(abstract);planning(abstract)

AI总结 PDDL-ART是一种基于VLM的框架,可自主从演示生成PDDL描述,经多阶段校正确保语义对齐,在发动机维护和家庭操纵任务上平均成功率达93.3%,优于基线规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17831 2026-08-19 astro-ph.IM 新提交 67%

Simulation tools for realistic high-order wavefront correction with the Roman Coronagraph

用于罗曼日冕仪真实高阶波前校正的模拟工具

A. Lau, A. J. Riggs, S. F. Redmond, E. Cady, J. Krist, I. Laginja, D. Sirbu, L. Delaye, R. Soummer, S. Noiret, J. C. Lambert, A. Bidot

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 本文介绍了可配置模拟框架corgihowfsc,用于罗曼日冕仪真实高阶波前校正研究,可保留参考工作流程并结合高保真图像模型,支持受控对比研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17959 2026-08-19 cs.AI cs.LG 新提交 62%

Towards Zero-Shot Task Transfer with Neurosymbolic World Models

面向基于神经符号世界模型的零样本任务迁移

Isidoro Tamassia, Lennert De Smet, Giuseppe Marra

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出一种神经符号世界模型,通过解耦观测重构与奖励预测,实现无需额外环境交互的零样本任务迁移,其泛化能力优于纯神经方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17542 2026-08-19 cs.LG cs.AI 新提交 62%

No Gaussian Required: Contrastive Inverse Dynamics for JEPA World Models

无需高斯:用于JEPA世界模型的对比逆动力学

Jack Boylan, Chris Hokamp

机构 * Quantexa(昆泰克萨公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出AC-MTM,用对比逆动力学替代JEPA世界模型的高斯型抗坍塌机制,在多目标视觉任务上性能优于SIGReg,且训练稳定无额外复杂组件

Comments 17 pages, 5 figures. Code: https://github.com/jackboyla/action-contrastive-jepa

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17718 2026-08-19 cs.AI 新提交 57%

Beyond Suspicious Steps: Ontological Trust in Long-Horizon Agents

超越可疑步骤:长周期智能体的本体论信任

An He, Yao Wang, Haibin Zhang

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出本体论信任概念,构建沿角色、目标、证据分解信任的在线监控器RGE,在跨领域轨迹语料库上,RGE的前缀配对漂移检测性能优于各类基线,漂移F1超93%且良性覆盖率达95.8%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17596 2026-08-19 cs.RO cs.AI 新提交 57%

tinyDSM: A Framework for Skill Modeling and Development for Resource-Constrained Millirobots

tinyDSM:面向资源受限毫米级机器人的技能建模与开发框架

Markus D. Kobelrausch, Michael Miedler, Axel Jantsch

机构 * Institute of Computer Technology, TU Wien(维也纳工业大学计算机技术研究所)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本研究提出面向资源受限毫米级机器人的 tinyDSM 框架,结合内在动机与适应性评估,依托分层知识图谱等实现技能建模,使机器人15分钟内自主掌握从基础到复杂的运动技能。

Comments Manuscript submitted to IEEE Transactions on Cognitive and Developmental Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17341 2026-08-19 cs.AI 新提交 57%

LLM-Only PDDL Domain Repair with Open-Weight Models

仅使用大语言模型的PDDL领域修复:基于开放权重模型

Nader Karimi Bavandpour, Pascal Bercher

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文评估开放权重大语言模型仅用LLM方法修复PDDL模型错误的能力,发现其F1分数优于符号基线,但测试通过率仍不足,无法保证满足修复所需的测试约束。

详情

展开后加载摘要…

URL PDF HTML 收藏