arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-16 至 2026-01-16 共收录 30 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 30 篇

2601.09980 2026-01-16 cond-mat.mtrl-sci cs.AI cs.LG 81%

Performance of AI agents based on reasoning language models on ALD process optimization tasks

基于推理语言模型的AI代理在ALD过程优化任务中的性能

Angel Yanguas-Gil

机构 * Applied Materials Division, Argonne National Laboratory, Lemont, IL 60439, USA(阿贡国家实验室应用材料部)

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI、cs.LG

AI总结 研究基于推理语言模型的AI代理在ALD过程优化中的性能,发现其能有效完成优化任务,但存在响应不确定性及潜在的推理偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10455 2026-01-16 cs.CL cs.RO 79%

SurgGoal: Rethinking Surgical Planning Evaluation via Goal-Satisfiability

SurgGoal: 重新思考手术计划评估 via 目标满足性

Ruochen Li, Kun Yuan, Yufei Xia, Yue Zhou, Qingyu Lu, Weihang Li, Youxiang Zhu, Nassir Navab

机构 * Technical University of Munich, Germany(慕尼黑技术大学) University of Strasbourg, France(斯特拉斯堡大学) University of Glasgow, United Kingdom(格拉斯哥大学) Nanyang Technological University, Singapore(南洋理工大学) University of Massachusetts Boston, USA(马萨诸塞大学波士顿分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.CL

AI总结 SurgGoal通过目标满足性度量重新评估手术计划,揭示视频大语言模型在安全关键环境中的性能问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10222 2026-01-16 cs.AI 79%

Compartmentalised Agentic Reasoning for Clinical NLI

临床自然语言推理中的 compartmentalised agentic 推理

Maël Jullien, Lei Xu, Marco Valentino, André Freitas

机构 * Department of Computer Science, University of Manchester, UK(曼彻斯特大学计算机科学系) National Biomarker Centre, CRUK-MI, University of Manchester, UK(曼彻斯特大学国家生物标记中心) Idiap Research Institute, Switzerland(日内瓦IDIAP研究所) School of Computer Science, University of Sheffield, UK(谢菲尔德大学计算机科学系) École Polytechnique Fédérale de Lausanne (EPFL), Switzerland(洛桑联邦理工学院(EPFL))

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI

AI总结 CARENLI 通过 compartmentalisation 和验证提升临床自然语言推理的准确率,从 23% 提高到 57%

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19126 2026-01-16 cs.CL 79%

AWPO: Enhancing Tool-Use of Large Language Models through Adaptive Integration of Reasoning Rewards

AWPO: 通过适应性整合推理奖励增强大语言模型的工具使用

Zihan Lin, Xiaohan Wang, Hexiong Yang, Jiajun Chai, Jie Cao, Guojun Yin, Wei Lin, Ran He

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 规划决策 :tool-use(title,abstract);分类 cs.CL

AI总结 AWPO通过适应性整合推理奖励提升大语言模型的工具使用性能,实现多轮场景中的卓越表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10340 2026-01-16 cs.RO 78%

CHORAL: Traversal-Aware Planning for Safe and Efficient Heterogeneous Multi-Robot Routing

CHORAL: 为安全高效的异构多机器人路由进行路径感知规划

David Morilla-Cabello, Eduardo Montijano

机构 * Instituto de Investigación en Ingeniería de Aragón, Universidad de Zaragoza(阿拉贡工程研究所,萨拉戈萨大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 CHORAL通过集成语义感知框架,利用开放词汇视觉模型构建度量-语义地图,为异构多机器人提供安全高效的路径规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24024 2026-01-16 eess.SY cs.RO cs.SY 78%

Exploiting Euclidean Distance Field Properties for Fast and Safe 3D planning with a modified Lazy Theta*

利用欧几里得距离场属性实现快速且安全的3D规划的改进懒惰Theta*算法

Jose A. Cobano, L. Merino, F. Caballero

机构 * Service Robotics Lab (SRL) University Pablo de Olavide Seville, Spain(服务机器人实验室(SRL) 奥林匹克大学 塞维利亚,西班牙)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于EDF的改进懒惰Theta*算法,用于快速生成安全且平滑的3D路径,通过优化成本函数和邻居选择机制提升计算效率和安全性。

Journal ref Published in Robotics and Autonomous Systems (RAS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10178 2026-01-16 eess.SY cs.SY 78%

HyMGP: A Customized MILP-Based Tool for Techno-Economic Planning of Islanded Microgrids

HyMGP:一种基于混合整数线性规划的定制化微电网经济规划工具

Andres Intriago, Rongxing Hu, Nabil Mohammed, S. Gokul Krishnan, Konstantinos Kotsovos, Issam Gereige, Nesren Attiah, Ali Basaheeh, Sarah Aqeel, Hamad A. Saiari, Shehab Ahmed, Charalambos Konstantinou

专题命中 规划决策 :planning(title,abstract)

AI总结 HyMGP是一种基于MILP的定制化微电网规划工具,通过优化组件尺寸和约束条件,提供更灵活的经济规划方案。

Comments 2026 IEEE Power & Energy Society (PES) International Meeting (IM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10173 2026-01-16 cs.CR cs.AI cs.CL 73%

ReasAlign: Reasoning Enhanced Safety Alignment against Prompt Injection Attack

ReasAlign: 基于推理增强的安全对齐以抵御提示注入攻击

Hao Li, Yankai Yang, G. Edward Suh, Ning Zhang, Chaowei Xiao

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) NVIDIA(NVIDIA公司) Johns Hopkins University(约翰霍普金斯大学)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI、cs.CL

AI总结 ReasAlign通过结构化推理和测试时缩放机制,有效防御提示注入攻击,实现安全与效用的最佳平衡。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05467 2026-01-16 cs.SE cs.AI 73%

STELP: Secure Transpilation and Execution of LLM-Generated Programs

STELP: 保障LLM生成程序的编译与执行

Swapnil Shinde, Sahil Wadhwa, Andy Luo, Akshay Gupta, Mohammad Shahed Sorower

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 STELP通过安全编译和执行LLM生成的代码,解决生产环境中的安全性和可靠性问题,提升代码执行的安全性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17462 2026-01-16 cs.RO 71%

Sampling-Based Constrained Motion Planning with Products of Experts

基于采样法的约束运动规划与专家产品

Amirreza Razmjoo, Teng Xue, Suhan Shetty, Sylvain Calinon

机构 * Idiap Research Institute(Idiap研究机构) École Polytechnique Fédérale de Lausanne (EPFL)(瑞士联邦理工学院)

专题命中 规划决策 :planning(title)

AI总结 本文提出了一种基于专家产品的采样方法,用于改进约束优化中的MPC性能,通过先投影再采样的策略提升效率和探索多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13033 2026-01-16 cs.RO cs.SY eess.SY 71%

Singularity-Free Guiding Vector Field over Bézier's Curves Applied to Rovers Path Planning and Path Following

无奇异引导向量场在贝塞尔曲线上的应用:用于轮式移动机器人路径规划与路径跟随

Alfredo González-Calvin, Lía García-Pérez, Juan Jiménez

机构 * Dept. Arquitectura de Computadores y Automática Facultad de Ciencias Físicas. Universidad Complutense Madrid, Spain(计算机架构与自动化系物理科学学院. 哥伦布大学马德里分校)

专题命中 规划决策 :planning(title)

AI总结 本文提出了一种无奇异引导向量场方法,用于轮式移动机器人在参数化路径上的路径规划与跟随,结合可变曲率速度设定点,以提高路径收敛性能。

Comments Final version, accepted for publication. 26 pages, 15 figures

Journal ref Journal of Field Robotics, 2025. 42:2720-27-39

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10179 2026-01-16 eess.SP 71%

Service Provisioning and Path Planning with Obstacle Avoidance for Low-Altitude Wireless Networks

低空无线网络中无人机作为空中基站的部署与路径规划及障碍规避

Senning Wan, Bin Li, Hongbin Chen, Lei Liu

专题命中 规划决策 :planning(title)

AI总结 本文提出了一种基于深度强化学习的无人机路径规划与障碍规避方法,通过联合优化轨迹、波束成形和关联指标,提升低空无线网络的服务质量与系统性能。

Comments 12 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03870 2026-01-16 cs.AI 70%

Uncovering Systemic and Environment Errors in Autonomous Systems Using Differential Testing

通过微分测试揭示自主系统中的系统性与环境误差

Yashwanthi Anand, Rahil P Mehta, Manish Motwani, Sandhya Saisubramanian

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 AIProbe通过微分测试识别自主系统中系统性与环境误差,提升部署可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10349 2026-01-16 cs.LG cs.AI cs.CL cs.GT 67%

SuS: Strategy-aware Surprise for Intrinsic Exploration

SuS:基于策略的惊喜用于内在探索

Mark Kashirskiy, Ilya Makarov

机构 * Higher School of Economics(俄罗斯高等经济学院) AI Talent Hub(人工智能人才中心) ITMO University(ITMO大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 SuS通过结合策略稳定性与策略惊喜,提升强化学习中探索的准确性和多样性,实现显著性能提升。

Comments 8 pages, 7 figures, 3 tables. Code available at https://github.com/mariklolik/sus

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09858 2026-01-16 cs.CL cs.AI cs.LG 67%

OUTLINEFORGE: Hierarchical Reinforcement Learning with Explicit States for Scientific Writing

OUTLINEFORGE: 基于显式状态的分层强化学习用于科学写作

Yilin Bao, Ziyao He, Zayden Yang

机构 * UC San Diego(圣迭戈大学) Ohio State University(俄亥俄州立大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 OUTLINEFORGE通过分层强化学习和显式状态管理,提升科学写作的全局结构和引用一致性,改进文档规划和事实准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00423 2026-01-16 cs.LG cs.AI cs.RO 62%

Bootstrap Off-policy with World Model

通过世界模型进行Bootstrap离策略学习

Guojian Zhan, Likun Wang, Xiangteng Zhang, Jiaxin Gao, Masayoshi Tomizuka, Shengbo Eben Li

机构 * College of AI & School of Vehicle and Mobility, Tsinghua University(人工智能学院与车辆与移动系统学院,清华大学) Berkeley AI Research (BAIR), UC Berkeley(伯克利人工智能研究(BAIR),加州大学伯克利分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 BOOM通过整合规划与离策略学习,利用世界模型和无参数动作分布提升策略性能,在高维控制任务中实现训练稳定性和最终性能的突破。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17523 2026-01-16 cs.CL cs.AI 62%

Bayesian Teaching Enables Probabilistic Reasoning in Large Language Models

贝叶斯教学使大语言模型具备概率推理能力

Linlu Qiu, Fei Sha, Kelsey Allen, Yoon Kim, Tal Linzen, Sjoerd van Steenkiste

机构 * MIT(麻省理工学院) Meta Google(谷歌公司) DeepMind University of British Columbia(不列颠哥伦比亚大学深度思维学院) Vector Institute(向量研究所) New York University(纽约大学) Google Research(谷歌研究)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 通过教学使大语言模型模仿贝叶斯模型预测,提升其概率推理能力并推广至新任务。

Comments Nature Communications

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10418 2026-01-16 cs.LG stat.ML 57%

Reinforcement Learning with Multi-Step Lookahead Information Via Adaptive Batching

通过自适应分组实现多步前瞻信息的强化学习

Nadav Merlis

机构 * The Faculty of Data and Decision Sciences, Technion -- Israel Institute of Technology, Israel(数据与决策科学系,技术Ion理工学院——以色列理工学院,以色列)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出自适应分组策略以解决多步前瞻信息下的强化学习问题,设计了乐观 regrets 最小化算法,实现了与未知环境交互时的最优策略学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10407 2026-01-16 cs.LG 57%

CS-GBA: A Critical Sample-based Gradient-guided Backdoor Attack for Offline Reinforcement Learning

CS-GBA:一种基于关键样本的梯度引导后门攻击用于离线强化学习

Yuanjie Zhao, Junnan Qiu, Yue Ding, Jie Li

机构 * Shanghai Jiao Tong University(上海交通大学) SJTU Paris Elite Institute of Technology(上海交通大学巴黎精英技术学院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 CS-GBA提出了一种基于关键样本的梯度引导后门攻击方法,通过优化攻击预算和隐蔽性,有效对抗安全约束算法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10148 2026-01-16 cs.AI 57%

DecisionLLM: Large Language Models for Long Sequence Decision Exploration

DecisionLLM: 用于长序列决策探索的大型语言模型

Xiaowei Lv, Zhilin Zhang, Yijun Li, Yusen Huo, Siyuan Ju, Xuyan Li, Chunxiang Hong, Tianyu Wang, Yongcai Wang, Peng Sun, Chuan Yu, Jian Xu, Bo Zheng

机构 * Renmin University of China, Beijing China(中国人民大学) Alibaba Group, Beijing, China(阿里巴巴集团)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 DecisionLLM基于Transformer架构,通过将轨迹视为独立模态,解决LLMs在连续值解释上的不足,实现长序列决策任务的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10080 2026-01-16 cs.CL 57%

Deriving Character Logic from Storyline as Codified Decision Trees

从故事线推导出角色逻辑作为编码决策树

Letian Peng, Kun Zhou, Longfei Yun, Yupeng Hou, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 本文提出CDT框架,通过大规模叙述数据诱导可执行且可解释的决策树结构,提升角色扮演代理行为的可靠性与可维护性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09755 2026-01-16 cs.NE cs.AI cs.RO 57%

Heterogeneous computing platform for real-time robotics

异构计算平台用于实时机器人

Jakub Fil, Yulia Sandamirskaya, Hector Gonzalez, Loïc Azzalin, Stefan Glüge, Lukas Friedenstab, Friedrich Wolf, Tim Rosmeisl, Matthias Lohrmann, Mahmoud Akl, Khaleel Khan, Leonie Wolf, Kristin Richter, Holm Puder, Mazhar Ali Bari, Xuan Choo, Noha Alharthi, Michael Hopkins, Mansoor Hanif Christian Mayr, Jens Struckmeier, Steve Furber

机构 * WAIYS GmbH(WAIYS公司) Zurich University of Applied Sciences(苏黎世应用科学大学) SpiNNcloud Systems GmbH(SpiNNcloud系统公司) TU Dresden(德累斯顿技术大学) Applied Brain Research(应用脑科研) NEOM The University of Manchester(曼彻斯特大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文提出一种异构计算平台,结合神经形态计算硬件与AI计算集群,用于实时机器人感知与交互任务,提升机器人自主性和智能水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19336 2026-01-16 cs.CV 50%

GANeXt: A Fully ConvNeXt-Enhanced Generative Adversarial Network for MRI- and CBCT-to-CT Synthesis

GANeXt: 一种完全基于ConvNeXt增强的生成对抗网络用于MRI和CBCT到CT的合成

Siyuan Mei, Yan Xia, Fuxin Fan, Andreas Maier

机构 * Pattern Recognition Lab, Friedrich-Alexander-University Erlangen-Nuremberg, Erlangen, Germany(弗里德里希-亚历山大-埃尔朗根-纽伦堡大学) Department of Orthodontics and Orofacial Orthopedics, Friedrich-Alexander-University Erlangen-Nuremberg, Erlangen, Germany(正畸学与口腔正外科系) Digital Technology and Innovation, Siemens Healthineers, Shanghai, China(西门子医疗创新)

专题命中 规划决策 :planning(abstract)

AI总结 GANeXt通过ConvNeXt增强的生成对抗网络实现MRI和CBCT到CT的跨模态合成,结合多种损失函数提升合成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.16607 2026-01-16 quant-ph 50%

Path Matters: Industrial Data Meet Quantum Optimization

路径至关重要:工业数据与量子优化

Lukas Schmidbauer, Carlos A. Riofrío, Florian Heinrich, Vanessa Junk, Ulrich Schwenk, Thomas Husslein, Wolfgang Mauerer

专题命中 规划决策 :planning(abstract)

AI总结 本研究通过工业数据评估不同量子优化路径,发现D-Wave硬件的QA在工作分配优化中表现优异,而IBM设备的LR-QAOA效果较差,表明硬件和求解器策略对性能有显著影响。

Journal ref Proceedings of the 2025 IEEE International Conference on Quantum Computing and Engineering (QCE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10208 2026-01-16 cs.RO 50%

Terrain-Adaptive Mobile 3D Printing with Hierarchical Control

地形自适应移动三维打印与分层控制

Shuangshan Nors Li, J. Nathan Kutz

机构 * Department of Electrical and Computer Engineering, University of Washington, USA(电气与计算机工程系,华盛顿大学) Department of Applied Mathematics, University of Washington, USA(应用数学系,华盛顿大学)

专题命中 规划决策 :planning(abstract)

AI总结 本研究提出了一种结合人工智能与分层控制的地形自适应移动三维打印框架,通过多传感器融合和闭环控制实现高精度打印与移动性平衡。

Comments Submitted to the 43rd International Symposium on Automation and Robotics in Construction (ISARC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09821 2026-01-16 stat.AP math.OC 50%

Forecasting Seasonal Peaks of Pediatric Respiratory Infections Using an Alert-Based Model Combining SIR Dynamics and Historical Trends in Santiago, Chile

利用结合SIR动态和历史趋势的警报模型预测智利圣地亚哥儿童呼吸道感染季节性高峰

Gloria Henríquez, Jhoan Báez, Víctor Riquelme, Pedro Gajardo, Michel Royer, Héctor Ramírez

专题命中 规划决策 :planning(abstract)

AI总结 本研究提出结合SIR动态和历史趋势的警报模型,用于预测智利圣地亚哥儿童呼吸道感染住院高峰的时间和规模,提升医院应急准备能力。

Comments 13 pages, 6 figures, 5 tables. Includes an alert-based forecasting algorithm and an appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09795 2026-01-16 math.AG cs.SC 50%

On some Exotic Cylindrical Algebraic Decompositions and Cells

关于某些奇特的柱形代数分解和细胞

Lucas Michel

专题命中 规划决策 :planning(abstract)

AI总结 本文通过构造特定的CADs和CAD细胞实例,推翻了关于拓扑假设的几个猜想和开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04267 2026-01-16 physics.soc-ph cs.MA 50%

Information Theoretic Optimal Surveillance for Epidemic Prevalence in Networks

信息论最优监控以估计网络中的疫情流行率

Ritwick Mishra, Abhijin Adiga, Madhav Marathe, S. S. Ravi, Ravi Tandon, Anil Vullikanti

专题命中 规划决策 :planning(abstract)

AI总结 本文提出TESTPREV问题,通过最大化互信息选择网络节点以优化疫情流行率估计,提出GREEDYMI策略在IC模型下提升互信息和减少方差。

Comments 25 pages; Added acknowledgments; In Proceedings of the AAAI 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20412 2026-01-16 cs.CR 50%

MindGuard: Intrinsic Decision Inspection for Securing LLM Agents Against Metadata Poisoning

MindGuard:内在决策检查用于保护LLM代理免受元数据中毒攻击

Zhiqiang Wang, Haohua Du, Guanquan Shi, Junyang Zhang, HaoRan Cheng, Yunhao Yao, Kaiwen Guo, Xiang-Yang Li

专题命中 规划决策 :agent(abstract)

AI总结 MindGuard通过决策依赖图检测和归因LLM代理中的元数据中毒攻击,实现高精度的污染调用检测与溯源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.05643 2026-01-16 econ.TH 50%

Motivating Effort with Information about Future Rewards

通过未来回报信息激励努力

Chang Liu

专题命中 规划决策 :agent(abstract)

AI总结 本文研究了通过未来回报信息激励代理人努力的最优机制,发现委托人的耐心程度决定了动态披露的价值和最优策略结构。

详情

展开后加载摘要…

URL PDF HTML 收藏