arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2025-12-01 至 2025-12-01 共收录 44 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 44 篇

2511.18531 2025-12-01 cs.CR cs.PL 88%

LockForge: Automating Paper-to-Code for Logic Locking with Multi-Agent Reasoning LLMs

LockForge: 基于多智能体推理LLM的逻辑锁纸到代码自动化

Akashdeep Saha, Zeng Wang, Prithwish Basu Roy, Johann Knechtel, Ozgur Sinanoglu, Ramesh Karri

专题命中 规划决策 :agent(title,abstract);multi-agent(title,abstract)

AI总结 LockForge通过多智能体推理LLM自动化将逻辑锁论文描述转换为可执行代码,解决可重复性难题,提供系统化验证框架和基准测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18192 2025-12-01 cs.CV cs.AI 85%

ARIAL: An Agentic Framework for Document VQA with Precise Answer Localization

ARIAL:一个用于文档视觉问答的代理框架,具有精确答案定位

Ahmad Mohammadshirazi, Pinaki Prasad Guha Neogi, Dheeraj Kulshrestha, Rajiv Ramnath

机构 * Ohio State University(俄亥俄州立大学) Flairsoft(Flairsoft公司)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);planning(abstract);分类 cs.AI

AI总结 ARIAL通过代理协调专门工具,实现文档VQA的高精度和可解释性,取得最佳性能和可解释性成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22659 2025-12-01 cs.AI cs.CV 85%

Geometrically-Constrained Agent for Spatial Reasoning

几何约束代理用于空间推理

Zeren Chen, Xiaoya Lu, Zhijie Zheng, Pengrui Li, Lehan He, Yijin Zhou, Jing Shao, Bohan Zhuang, Lu Sheng

机构 * School of Software, Beihang University(北京航空航天大学软件学院) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) ZIP Lab, Zhejiang University(浙江大学ZIP实验室)

专题命中 规划决策 :agent(title,abstract);planning(abstract);agentic(abstract);分类 cs.AI

AI总结 Geometrically-Constrained Agent 通过引入正式任务约束,解决视觉语言模型在空间推理中的语义到几何差距问题,实现更稳健的推理路径。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18924 2025-12-01 cs.CL cs.AI 84%

Simulated patient systems powered by large language model-based AI agents offer potential for transforming medical education

基于大语言模型的AI代理的模拟患者系统有潜力改变医学教育

Huizi Yu, Jiayan Zhou, Lingyao Li, Shan Chen, Jack Gallifant, Anye Shi, Xiang Li, Jingxian He, Wenyue Hua, Mingyu Jin, Guang Chen, Yang Zhou, Zhao Li, Trisha Gupte, Ming-Li Chen, Zahra Azizi, Qi Dou, Bryan P. Yan, Yongfeng Zhang, Yanqiu Xing, Themistocles L. Danielle S. Bitterman, Themistocles L. Assimes, Xin Ma, Lin Lu, Lizhou Fan

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.AI、cs.CL

AI总结 基于大语言模型的AI代理构建的模拟患者系统在医学教育中展现出高保真度和教育价值,优于人类模拟患者。

Comments 19 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22181 2025-12-01 cs.CV cs.AI cs.RO 83%

MTR-VP: Towards End-to-End Trajectory Planning through Context-Driven Image Encoding and Multiple Trajectory Prediction

MTR-VP: 通过基于上下文的图像编码和多轨迹预测实现端到端轨迹规划

Maitrayee Keskar, Mohan Trivedi, Ross Greer

机构 * Machine Intelligence, Interaction, and Imagination (Mi 3 ) Laboratory(机器智能、交互与想象实验室) University of California, Merced(加州大学默塞德分校) Laboratory for Intelligent & Safe Automobiles (LISA)(智能与安全汽车实验室) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 MTR-VP通过基于上下文的图像编码和多轨迹预测实现端到端轨迹规划,利用交叉注意力提升规划性能。

Comments 8 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21706 2025-12-01 cs.CL cs.AI 81%

A General Highly Accurate Online Planning Method Integrating Large Language Models into Nested Rollout Policy Adaptation for Dialogue Tasks

一种整合大语言模型的通用高精度在线规划方法用于对话任务的嵌套回滚策略适应

Hui Wang, Fafa Zhang, Xiaoyu Zhang, Chaoxu Mu

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.CL

AI总结 本文提出NRPA-GD方法,利用大语言模型实现无需训练的对话策略规划,通过嵌套回滚策略适应在目标导向对话任务中取得优异表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14222 2025-12-01 cs.AI cs.CL cs.LG stat.OT 80%

A Survey on Large Language Model-based Agents for Statistics and Data Science

关于基于大型语言模型的统计与数据科学代理的综述

Maojun Sun, Ruijian Han, Binyan Jiang, Houduo Qi, Defeng Sun, Yancheng Yuan, Jian Huang

机构 * Department of Data Science and Artificial Intelligence, The Hong Kong Polytechnic University(数据科学与人工智能系,香港理工大学) Department of Applied Mathematics, The Hong Kong Polytechnic University(应用数学系,香港理工大学)

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 本文综述了基于大型语言模型的数据科学代理的发展、能力和应用,探讨了其设计趋势及实际应用,并提出了未来研究方向。

Journal ref Am. Statist. (2025) 1-14

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23387 2025-12-01 cs.AI 79%

Hierarchical AI-Meteorologist: LLM-Agent System for Multi-Scale and Explainable Weather Forecast Reporting

分层人工智能气象学家:用于多尺度和可解释性天气预报报告的LLM代理系统

Daniil Sukhorukov, Andrei Zakharov, Nikita Glazkov, Katsiaryna Yanchanka, Vladimir Kirilin, Maxim Dubovitsky, Roman Sultimov, Yuri Maksimov, Ilya Makarov

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 本文提出分层人工智能气象学家,通过多尺度推理和关键词生成提升天气预报的可解释性和鲁棒性。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21902 2025-12-01 cs.CV cs.AI 79%

PathReasoning: A multimodal reasoning agent for query-based ROI navigation on whole-slide images

PathReasoning: 一种用于基于查询的全滑片图像区域感兴趣点(ROI)导航的多模态推理代理

Kunpeng Zhang, Hanwen Xu, Sheng Wang

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 PathReasoning通过多模态推理代理实现基于查询的全滑片图像ROI导航,显著提升诊断准确性与报告生成效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23407 2025-12-01 cs.RO 78%

From CAD to POMDP: Probabilistic Planning for Robotic Disassembly of End-of-Life Products

从CAD到POMDP:用于废旧产品的机器人拆解的概率规划

Jan Baumgärtner, Malte Hansjosten, David Hald, Adrian Hauptmannl, Alexander Puchta, Jürgen Fleischer

机构 * wbk Institute of Production Science, Karlsruhe Institute of Technology(wbk生产科学研究所,卡尔斯鲁厄技术大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于POMDP的概率规划框架,用于机器人拆解废旧产品,通过考虑不确定性来提高拆解效率和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22865 2025-12-01 cs.RO cs.CV 78%

SUPER-AD: Semantic Uncertainty-aware Planning for End-to-End Robust Autonomous Driving

SUPER-AD:语义不确定性感知的端到端鲁棒自动驾驶规划

Wonjeong Ryu, Seungjun Yu, Seokha Moon, Hojun Choi, Junsung Park, Jinkyu Kim, Hyunjung Shim

机构 * KAIST AI(韩国科学技术院人工智能研究所) Korea University(韩国大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 SUPER-AD通过语义不确定性感知和驾驶先验知识,提升端到端自动驾驶在复杂不确定性条件下的安全性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22850 2025-12-01 cs.CV 78%

Resolving Evidence Sparsity: Agentic Context Engineering for Long-Document Understanding

解决证据稀疏性:面向长文档理解的代理情境工程

Keliang Liu, Zizhi Chen, Mingcheng Li, Jingqun Tang, Dingkang Yang, Lihua Zhang

专题命中 规划决策 :agentic(title);agent(abstract)

AI总结 SLEUTH通过多代理框架解决长文档理解中的证据稀疏问题,提升多模态文档处理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22123 2025-12-01 math.OC cs.SY eess.SY 78%

Model Predictive Path Planning in Navier-Stokes Flow with POD-Based Reduced-Order Models

在纳维-斯托克斯流中基于POD的降阶模型的模型预测路径规划

Adam Waterman, Martin Guay

专题命中 规划决策 :planning(title);agent(abstract)

AI总结 本文提出一种结合POD降阶模型与MPC的路径规划方法,用于在纳维-斯托克斯流中实现高效实时控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00840 2025-12-01 cs.RO 78%

Heuristic Step Planning for Learning Dynamic Bipedal Locomotion: A Comparative Study of Model-Based and Model-Free Approaches

基于启发式步态规划的学习动态双足运动:模型驱动与模型无关方法的比较研究

William Suliman, Ekaterina Chaikovskaia, Egor Davydenko, Roman Gorbachev

机构 * Moscow Institute of Physics and Technology(莫斯科物理技术学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种基于启发式步态规划的学习方法,通过比较模型驱动和模型无关方法,展示了在动态双足运动中实现稳定行走的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22904 2025-12-01 cs.CL cs.LG 74%

Language-conditioned world model improves policy generalization by reading environmental descriptions

语言引导的世界模型通过阅读环境描述提升策略泛化能力

Anh Nguyen, Stefan Lee

机构 * Oregon State University(俄勒冈州立大学)

专题命中 规划决策 :agent(abstract,comments);planning(abstract);分类 cs.CL、cs.LG

AI总结 本文提出LED-WM,通过语言引导的世界模型提升策略泛化能力,无需依赖假设,有效应对新动态和语言描述的未见过游戏。

Comments NeuRIPS 2025. Workshop: LAW 2025: Bridging Language, Agent, and World Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23262 2025-12-01 cs.AI 74%

Adapting Like Humans: A Metacognitive Agent with Test-time Reasoning

像人类一样适应:具有测试时推理的元认知代理

Yang Li, Zhiyuan He, Yuxuan Huang, Zhuhanling Xiao, Chao Yu, Meng Fang, Kun Shao, Jun Wang

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室) University of Oxford(牛津大学) Tsinghua University(清华大学) University of Liverpool(利物浦大学) University College London(伦敦大学学院)

专题命中 规划决策 :agent(title);分类 cs.AI

AI总结 本文提出元认知测试时推理框架,通过元认知自我更新实现模型在测试时的高效适应,实验表明其在Atari游戏中表现出优于基线的适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22134 2025-12-01 cs.CV cs.RO 71%

DualVLA: Building a Generalizable Embodied Agent via Partial Decoupling of Reasoning and Action

DualVLA: 通过推理与行动部分解耦构建通用具身代理

Zhen Fang, Zhuoyang Liu, Jiaming Liu, Hao Chen, Yu Zeng, Shiting Huang, Zehui Chen, Lin Chen, Shanghang Zhang, Feng Zhao

机构 * MoE Key Laboratory of Brain-inspired Intelligent Perception and Cognition, University of Science and Technology of China(脑启发智能感知与认知国家重点实验室,中国科学技术大学) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,北京大学计算机学院) CUHK(香港大学)

专题命中 规划决策 :agent(title)

AI总结 DualVLA通过推理与行动部分解耦,提升通用具身代理的行动与多模态理解平衡能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23193 2025-12-01 cs.RO cs.LG cs.SY eess.SY 70%

Fault-Tolerant MARL for CAVs under Observation Perturbations for Highway On-Ramp Merging

面向高速公路汇入车道的抗观测扰动多智能体强化学习故障容错方法

Yuchen Shi, Huaxin Pei, Yi Zhang, Danya Yao

机构 * Department of Automation, Tsinghua University(自动化系,清华大学) Beijing National Research Center for Information Science and Technology (BNRist), Tsinghua University(北京信息科学与技术国家研究中心(BNRist),清华大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出了一种面向高速公路汇入车道的抗观测扰动多智能体强化学习故障容错方法,通过对抗性扰动生成和故障容忍智能体设计,提升协同驾驶系统的安全性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22955 2025-12-01 cs.LG 70%

Experts are all you need: A Composable Framework for Large Language Model Inference

专家足矣:一种用于大语言模型推理的可组合框架

Shrihari Sridharan, Sourjya Roy, Anand Raghunathan, Kaushik Roy

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 Comp-LLM通过可组合的推理框架实现跨专家协作,提升大语言模型的准确性和效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22738 2025-12-01 cs.LG cs.CR 70%

ShieldAgent: Shielding Agents via Verifiable Safety Policy Reasoning

ShieldAgent: 通过可验证的安全策略推理实现安全代理

Zhaorun Chen, Mintong Kang, Bo Li

机构 * University of Chicago, Chicago IL, USA(芝加哥大学) University of Illinois at Urbana-Champaign, Champaign IL, USA(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.LG

AI总结 ShieldAgent通过逻辑推理实现对代理动作轨迹的安全策略合规性,有效提升代理防护性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22891 2025-12-01 cs.AI cs.CL cs.LG 67%

ORION: Teaching Language Models to Reason Efficiently in the Language of Thought

ORION:教语言模型以高效的方式在思维语言中推理

Kumar Tanmay, Kriti Aggarwal, Paul Pu Liang, Subhabrata Mukherjee

机构 * Harvard University(哈佛大学) Hippocratic AI(希波克拉底AI) Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 ORION通过SLPO优化实现高效压缩推理,提升推理效率和准确性,同时保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21757 2025-12-01 cs.CY cs.AI cs.CL cs.CR 62%

Medical Malice: A Dataset for Context-Aware Safety in Healthcare LLMs

医疗恶意:用于医疗LLM中情境感知安全的数据库

Andrew Maranhão Ventura D'addario

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 Medical Malice提出一个情境感知安全的医疗数据库,通过对抗性提示和伦理推理提升医疗LLM的安全性,以应对医疗领域复杂且系统性的威胁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21753 2025-12-01 cs.CL cs.AI 62%

Extracting Disaster Impacts and Impact Related Locations in Social Media Posts Using Large Language Models

利用大型语言模型从社交媒体帖子中提取灾害影响及影响相关位置

Sameeah Noreen Hameed, Surangika Ranathunga, Raj Prasanna, Kristin Stock, Christopher B. Jones

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 本文利用大型语言模型从社交媒体中提取灾害影响及受影响位置,提升灾害响应决策效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2108.06228 2025-12-01 cs.AI cs.LG 62%

One-shot Transfer Learning for Population Mapping

单样本迁移学习用于人口映射

Erzhuo Shao, Jie Feng, Yingheng Wang, Tong Xia, Yong Li

机构 * Beijing National Research Center for Information Science and Technology (BNRist)(北京国家信息科学与技术研究中心(BNRist)) Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出PSRNet框架,通过单样本迁移学习方法从数据充足城市向数据稀缺城市转移空间-时间知识,提升细粒度人口分布映射的准确性。

Comments Published in Proceedings of the 30th ACM International Conference on Information and Knowledge Management (CIKM '21)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23243 2025-12-01 cs.LG eess.SP 57%

Heteroscedastic Neural Networks for Path Loss Prediction with Link-Specific Uncertainty

异方差神经网络用于具有链路特定不确定性的路径损耗预测

Jonathan Ethier

机构 * Communications Research Centre, Canada(加拿大通讯研究中心)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出异方差神经网络用于路径损耗预测,通过联合预测均值和链路特定方差,提升预测精度与不确定性估计,优化射频规划与干扰分析。

Comments Submitted to IEEE AWPL in December 2025. 5 pages, 2 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23072 2025-12-01 eess.SP cs.AI stat.AP 57%

What If They Took the Shot? A Hierarchical Bayesian Framework for Counterfactual Expected Goals

如果他们投篮会怎样?一个用于反事实预期进球的分层贝叶斯框架

Mikayil Mahmudlu, Oktay Karakuş, Hasan Arkadaş

机构 * Cardiff University, School of Mathematics(卡地夫大学数学学院) Cardiff University, School of Computer Science and Informatics(卡地夫大学计算机科学与信息学学院) Dead Ball Analytics Limited(Dead Ball Analytics有限公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出分层贝叶斯框架,通过整合专家知识提升xG估计精度,揭示球员专精特征和潜在能力,支持反事实分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19408 2025-12-01 cs.LG cs.CV eess.SP 57%

Axial-UNet: A Neural Weather Model for Precipitation Nowcasting

Axial-UNet:一种用于降水nowcasting的神经天气模型

Sumit Mamtani, Maitreya Sonawane

机构 * New York University(纽约大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 Axial-UNet通过轴向注意力块和混合架构实现高效的降水nowcasting,优于现有方法并在像素保真度上取得显著成绩。

Comments 16 pages, 3 figures. Accepted at the International Conference on Distributed Computing and Intelligent Technology (ICDCIT 2026), to appear in Springer LNCS

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22325 2025-12-01 cs.AI 57%

Tracing Footsteps of Similar Cities: Modeling Urban Economic Vitality with Dynamic Inter-City Graph Embeddings

追踪相似城市的足迹:通过动态跨城市图嵌入建模城市经济活力

Xiaofeng Li, Xiangyi Xiao, Xiaocong Du, Ying Zhang, Haipeng Zhang

机构 * ShanghaiTech University(上海科技大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 ECO-GROW通过动态跨城市图嵌入建模城市经济活力,整合产业联系、POI相似性等多维度数据,提升对城市经济活力的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21758 2025-12-01 cs.CR cs.AI cs.CY 57%

A Longitudinal Measurement of Privacy Policy Evolution for Large Language Models

大型语言模型隐私政策演变的纵向测量

Zhen Tao, Shidong Pan, Zhenchang Xing, Emily Black, Talia Gillis, Chunyang Chen

机构 * Technical University of Munich(慕尼黑技术大学) Columbia University(哥伦比亚大学) New York University(纽约大学) CSIRO’s Data61(CSIRO的数据61)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 本文首次对全球主流LLM提供者的隐私政策进行了纵向研究,揭示了隐私政策的演变趋势、内容特征及地区差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21631 2025-12-01 cs.CV cs.AI 57%

Qwen3-VL Technical Report

Qwen3-VL 技术报告

Shuai Bai, Yuxuan Cai, Ruizhe Chen, Keqin Chen, Xionghui Chen, Zesen Cheng, Lianghao Deng, Wei Ding, Chang Gao, Chunjiang Ge, Wenbin Ge, Zhifang Guo, Qidong Huang, Jie Huang, Fei Huang, Binyuan Hui, Shutong Jiang, Zhaohai Li, Mingsheng Li, Mei Li, Kaixin Li, Zicheng Lin, Junyang Lin, Xuejing Liu, Jiawei Liu, Chenglong Liu, Yang Liu, Dayiheng Liu, Shixuan Liu, Dunjie Lu, Ruilin Luo, Chenxu Lv, Rui Men, Lingchen Meng, Xuancheng Ren, Xingzhang Ren, Sibo Song, Yuchong Sun, Jun Tang, Jianhong Tu, Jianqiang Wan, Peng Wang, Pengfei Wang, Qiuyue Wang, Yuxuan Wang, Tianbao Xie, Yiheng Xu, Haiyang Xu, Jin Xu, Zhibo Yang, Mingkun Yang, Jianxin Yang, An Yang, Bowen Yu, Fei Zhang, Hang Zhang, Xi Zhang, Bo Zheng, Humen Zhong, Jingren Zhou, Fan Zhou, Jing Zhou, Yuanzhi Zhu, Ke Zhu

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 Qwen3-VL 是一款强大的多模态模型,具备强大的纯文本理解、长上下文处理和多模态推理能力,适用于图像推理、代理决策和多模态代码智能。

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏