arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-01-21 至 2026-01-21 共收录 249 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 88 篇

2601.13843 2026-01-21 eess.SY cs.SY 86%

Small Models, Big Impact: Tool-Augmented AI Agents for Wireless Network Planning

小型模型,大影响:用于无线网络规划的工具增强型AI代理

Yongqiang Zhang, Mustafa A. Kishk, Mohamed-Slim Alouini

专题命中 规划决策 :AI agent(title);planning(title);agent(abstract)

AI总结 MAINTAINED通过整合地理分析、信号传播建模和网络优化的计算工具,实现了比大型语言模型更高效的无线网络规划,同时减少计算资源需求。

Comments 7 pages, 4 figures, 2 tables, accepted by IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12740 2026-01-21 cs.HC cs.AI 85%

TreeWriter: AI-Assisted Hierarchical Planning and Writing for Long-Form Documents

TreeWriter: 人工智能辅助的长篇文档分层规划与写作

Zijian Zhang, Fangshi Du, Xingjian Liu, Pan Chen, Oliver Huang, Runlong Ye, Michael Liut, Alán Aspuru-Guzik

机构 * Department of Computer Science, University of Toronto, Sandford Fleming Building, 10 King’s College Road, ON M5S 3G4, Toronto, Canada Vector Institute for Artificial Intelligence, 661 University Ave. Suite 710, ON M5G 1M1, Toronto, Canada Department of Chemistry, University of Toronto, Lash Miller Chemical Laboratories, 80 St. George Street, ON M5S 3H6, Toronto, Canada Department of Mathematical Computational Sciences, University of Toronto Mississauga, 3359 Mississauga Road, Deerfield Hall, ON L5L 1C6, Mississauga, Canada Department of Materials Science \& Engineering, University of Toronto, 184 College St., M5S 3E4, Toronto, Canada Department of Chemical Engineering \& Applied Chemistry, University of Toronto, 200 College St. ON M5S 3E5, Toronto, Canada Acceleration Consortium, 700 University Ave., M7A 2S4, Toronto, Canada Canadian Institute for Advanced Research (CIFAR), 661 University Ave., M5G 1M1, Toronto, Canada NVIDIA, 431 King St W \#6th, M5V 1K4, Toronto, Canada

专题命中 规划决策 :planning(title,abstract);agent(abstract);AI agent(abstract);分类 cs.AI

AI总结 TreeWriter通过分层结构和集成AI支持,提升长文档写作中的创意发展和用户控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25482 2026-01-21 cs.AI cs.LG cs.RO cs.SY eess.SY stat.ML 84%

Message passing-based inference in an autoregressive active inference agent

基于消息传递的自回归主动推断代理推理

Wouter M. Kouw, Tim N. Nisslbeck, Wouter L. N. Nuijten

机构 * Eindhoven University of Technology(埃因霍温理工大学) Lazy Dynamics B.V.(Lazy Dynamics公司)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种基于消息传递的自回归主动推断代理,通过在因子图上进行推理,在机器人导航任务中展示了在连续观测空间中实现探索与利用的能力,并在动态建模方面优于传统控制器。

Comments 14 pages, 4 figures, proceedings of the International Workshop on Active Inference 2025. Erratum v1: in Eq. (50), $p(y_t, Θ, u_t \mid y_{*}, \mathcal{D}_k)$ should have been $p(y_t, Θ\mid u_t, y_{*}, \mathcal{D}_k)$

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13653 2026-01-21 cs.LG 83%

TimeART: Towards Agentic Time Series Reasoning via Tool-Augmentation

TimeART: 通过工具增强实现代理时间序列推理

Xingjian Wu, Junkai Lu, Zhengyu Li, Xiangfei Qiu, Jilin Hu, Chenjuan Guo, Christian S. Jensen, Bin Yang

机构 * East China Normal University, Shanghai, China(华东师范大学) Aalborg University, Aalborg, Denmark(奥胡斯大学)

专题命中 规划决策 :agentic(title,abstract);tool-use(abstract);分类 cs.LG

AI总结 TimeART通过融合强大工具的分析能力与LLM的推理能力,实现时间序列问题回答的自主代理方法,通过四阶段训练策略提升模型泛化能力,并在多个任务中取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13572 2026-01-21 cs.LG 83%

Behavior Knowledge Merge in Reinforced Agentic Models

强化学习代理模型中的行为知识融合

Xiangchi Yuan, Dachuan Shi, Chunhui Zhang, Zheyuan Liu, Shenglong Yao, Soroush Vosoughi, Wenke Lee

机构 * Georgia Institute of Technology(佐治亚理工学院) Dartmouth College(达特茅斯学院) University of Notre Dame(诺丁汉大学)

专题命中 规划决策 :agentic(title,abstract);agent(abstract);分类 cs.LG

AI总结 本文提出RAM框架,通过分离共享和任务特定参数更新,提升RL训练代理模型的融合效果,实现性能超越专门化代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06860 2026-01-21 cs.AI 83%

ET-Agent: Incentivizing Effective Tool-Integrated Reasoning Agent via Behavior Calibration

ET-Agent:通过行为校准激励有效的工具集成推理代理

Yifei Chen, Guanting Dong, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院)

专题命中 规划决策 :agent(title,abstract);tool-use(abstract);分类 cs.AI

AI总结 ET-Agent通过自我进化数据飞轮和行为校准训练框架,提升工具集成推理代理的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07478 2026-01-21 cs.CL 79%

Enhancing Agentic RL with Progressive Reward Shaping and Value-based Sampling Policy Optimization

通过渐进奖励塑造与基于价值的采样策略优化增强代理强化学习

Jianghao Su, Xia Zeng, Luhui Liu, Chao Luo, Ye Chen, Zhuoran Zhuang

机构 * Xi’an Jiaotong University(西安交通大学) Fliggy Alibaba(阿里飞猪)

专题命中 规划决策 :agentic(title,abstract);分类 cs.CL

AI总结 本文提出PRS和VSPO技术,通过渐进奖励塑造和基于价值的采样策略优化,提升代理强化学习在复杂推理任务中的性能与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13114 2026-01-21 cs.NI cs.AI cs.SY eess.SY 79%

IntAgent: NWDAF-Based Intent LLM Agent Towards Advanced Next Generation Networks

IntAgent:基于网络切片分析功能的意图LLM代理面向下一代高级网络

Abdelrahman Soliman, Ahmed Refaey, Aiman Erbad, Amr Mohamed

机构 * University of Guelph(圭尔夫大学) Qatar University(卡塔尔大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 IntAgent通过整合NWDAF分析与工具,实现基于意图的网络自动化管理,提升网络操作的智能化和动态响应能力。

Comments conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12742 2026-01-21 cs.RO cs.AI 79%

AirHunt: Bridging VLM Semantics and Continuous Planning for Efficient Aerial Object Navigation

AirHunt: 通过融合视觉语言模型语义与连续规划实现高效空中物体导航

Xuecheng Chen, Zongzhuo Liu, Jianfa Ma, Bang Du, Tiantian Zhang, Xueqian Wang, Boyu Zhou

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Department of Mechanical and Energy Engineering, Southern University of Science and Technology(南方科技大学机械与能源工程系) Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Department of Physics, Southern University of Science and Technology(南方科技大学物理系)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 AirHunt通过融合视觉语言模型语义与连续规划,实现高效空中物体导航,提升开放集物体定位的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12141 2026-01-21 cs.AI 79%

TIDE: A Trace-Informed Depth-First Exploration for Planning with Temporally Extended Goals

TIDE: 一种基于轨迹的深度优先探索用于具有时间扩展目标的规划

Yuliia Suprun, Khen Elimelech, Lydia E. Kavraki, Moshe Y. Vardi

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 TIDE通过分解时间问题为可达-避免子问题,结合成本驱动启发式方法,提升时间扩展目标规划的效率和完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06474 2026-01-21 cs.CV cs.AI 79%

SparseOccVLA: Bridging Occupancy and Vision-Language Models via Sparse Queries for Unified 4D Scene Understanding and Planning

SparseOccVLA: 通过稀疏查询弥合占用与视觉语言模型之间的鸿沟,实现统一的4D场景理解和规划

Chenxu Dang, Jie Wang, Guang Li, Zhiwen Hou, Zihan You, Hangjun Ye, Jie Ma, Long Chen, Yan Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Xiaomi EV(小米电动车) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 SparseOccVLA通过稀疏查询整合视觉语言模型与语义占用,实现统一的4D场景理解和规划,提升自动驾驶性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13702 2026-01-21 cs.NI 78%

IGAA: Intent-Driven General Agentic AI for Edge Services Scheduling using Generative Meta Learning

IGAA: 基于生成元学习的意图驱动通用代理AI用于边缘服务调度

Yan Sun, Yinqiu Liu, Shaoyong Guo, Ruichen Zhang, Feng Qi, Xuesong Qiu, Weifeng Gong, Dusit Niyato, Qihui Wu

专题命中 规划决策 :agentic(title,abstract)

AI总结 IGAA通过生成元学习和意图驱动机制,提升边缘服务调度的泛化能力与适应性,有效应对动态服务需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13196 2026-01-21 cs.RO 78%

Active Informative Planning for UAV-based Weed Mapping using Discrete Gaussian Process Representations

基于离散高斯过程表示的UAV weed映射主动信息规划

Jacob Swindell, Marija Popović, Riccardo Polvara

机构 * Lincoln Centre for Autonomous Systems (L-CAS)(林肯自主系统中心) Faculty of Aerospace Engineering, MAVLab(航空航天工程学院) Delft University of Technology (TU Delft)(代尔夫特理工大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种基于离散高斯过程表示的UAV主动信息规划方法,用于提高杂草制图的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11905 2026-01-21 cs.AI cs.LG math.ST stat.TH 76%

LIBRA: Language Model Informed Bandit Recourse Algorithm for Personalized Treatment Planning

LIBRA:基于语言模型的带状 recourse 算法用于个性化治疗计划

Junyu Cao, Ruijiang Gao, Esmaeil Keyvanshokooh, Jianhao Ma

机构 * McCombs School of Business, University of Texas at Austin(德克萨斯大学奥斯汀分校麦克斯韦商学院) Naveen Jindal School of Management, University of Texas at Dallas(德克萨斯大学达拉斯分校奈文·金达管理学院) Mays Business School, Texas A&M University(德克萨斯农工大学梅斯商学院) Wharton School, University of Pennsylvania(宾夕法尼亚大学沃顿商学院)

专题命中 规划决策 :planning(title);分类 cs.AI、cs.LG

AI总结 LIBRA 是一种结合大语言模型和带状学习的算法,用于在个性化治疗中实现更高效的决策和鲁棒性。

Comments 50 pages. Previous version with human-AI collaboration: arXiv:2410.14640

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15226 2026-01-21 cs.RO 71%

PolyFly: Polytopic Optimal Planning for Collision-Free Cable-Suspended Aerial Payload Transportation

PolyFly: 多面体最优规划用于无碰撞缆悬空空载运输

Mrunal Sarvaiya, Guanrui Li, Giuseppe Loianno

机构 * University of California Berkeley, Department of Electrical Engineering and Computer Sciences(加州大学伯克利分校电子工程与计算机科学系) Worcester Polytechnic Institute, Robotics Engineering(沃思黑德技术学院机器人工程)

专题命中 规划决策 :planning(title)

AI总结 PolyFly通过多面体最优规划实现无碰撞缆悬空空载运输,提升飞行效率和环境适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14238 2026-01-21 cs.LG 70%

Spatiotemporal Wildfire Prediction and Reinforcement Learning for Helitack Suppression

时空野火预测与直升机灭火强化学习

Shaurya Mathur, Shreyas Bellary Manjunath, Nitin Kulkarni, Alina Vereshchaka

机构 * Department of Computer Science(计算机科学系) Engineering University at Buffalo Buffalo, New York, USA(布法罗大学工程学院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.LG

AI总结 FireCastRL结合深度学习和强化学习,通过时空预测和物理模拟实现主动野火预测与灭火策略优化。

Comments 6 pages, 5 figures (two of them in tables), Conference: IEEE International Conference on Machine Learning and Applications 2025 (ICMLA 2025): https://www.icmla-conference.org/icmla25/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13546 2026-01-21 cs.AI 70%

ChatAD: Reasoning-Enhanced Time-Series Anomaly Detection with Multi-Turn Instruction Evolution

ChatAD: 基于推理增强的多轮指令演化的时序异常检测

Hui Sun, Chang Xu, Haonan Xie, Hao Li, Yuhao Huang, Chuheng Zhang, Ming Jin, Xiaoguang Liu, Gang Wang, Jiang Bian

机构 * Nankai University(南开大学) Microsoft Research Asia(微软亚洲研究院) Huanjiang Laboratory(焕江实验室) University of Manchester(曼彻斯特大学) Nanjing University(南京大学) Griffith University(格里菲斯大学)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI

AI总结 ChatAD通过多智能体演化算法和Kahneman-Tversky优化,提升了时序异常检测的推理能力和跨任务泛化性能,实现了显著的准确率和F1值提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17853 2026-01-21 cs.RO cs.AI 70%

AnyTask: an Automated Task and Data Generation Framework for Advancing Sim-to-Real Policy Learning

AnyTask: 一种用于推进仿真到现实策略学习的任务和数据生成框架

Ran Gong, Xiaohan Zhang, Jinghuan Shang, Maria Vittoria Minniti, Jigarkumar Patel, Valerio Pepe, Riedana Yan, Ahmet Gundogdu, Ivan Kapelyukh, Ali Abbas, Xiaoqiang Yan, Harsh Patel, Laura Herlant, Karl Schmeckpeper

机构 * Robotics and AI Institute(机器人与人工智能研究所)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 AnyTask通过自动化框架结合GPU仿真与基础模型,生成多样化任务和机器人数据,提升仿真到现实策略学习的效率与效果。

Comments 28 pages, 25 figures. The first four authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12988 2026-01-21 cs.LG 70%

PaperGuide: Making Small Language-Model Paper-Reading Agents More Efficient

PaperGuide: 使小型语言模型论文阅读代理更加高效

Zijian Wang, Tiancheng Huang, Hanqi Li, Da Ma, Lu Chen, Kai Yu

机构 * X-LANCE Lab, School of Computer Science, MoE Key Lab of Artificial Intelligence, SJTU AI Institute, Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室、计算机科学学院、人工智能关键实验室、SJTU人工智能研究所、上海交通大学、上海,中国) Suzhou Laboratory, Suzhou, China(苏州实验室、苏州,中国)

专题命中 规划决策 :autonomous agent(abstract);planning(abstract);分类 cs.LG

AI总结 PaperCompass通过分离高层规划与细粒度执行,提升小型语言模型在论文阅读任务中的效率,实现高效且可靠的训练过程。

Comments 35 pages, 9 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03227 2026-01-21 eess.SP cs.LG 70%

Transferable Graphical MARL for Real-Time Estimation in Dynamic Wireless Networks

可迁移的图形MARL用于动态无线网络中的实时估计

Xingran Chen, Navid NaderiAlizadeh, Alejandro Ribeiro, Shirin Saeedi Bidokhti

机构 * Department of Electrical and Computer Engineering, Rutgers University(罗格斯大学电气与计算机工程系) Department of Biostatistics and Bioinformatics, Duke University(杜克大学生物统计与生物信息学系) Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 本文提出了一种可迁移的图形MARL框架,用于动态无线网络中的实时估计,通过统一的多智能体强化学习方法,实现去中心化策略下的估计误差和信息年龄最小化,同时具备良好的迁移性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11529 2026-01-21 cs.HC cs.AI 70%

SNAP: A Plan-Driven Framework for Controllable Interactive Narrative Generation

SNAP:一种面向可控交互叙事生成的计划驱动框架

Geonwoo Bang, DongMyung Kim, Hayoung Oh

机构 * Sungkyunkwan University(成均馆大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 SNAP通过计划驱动的叙事单元结构,实现可控的交互叙事生成,提升场景一致性与用户响应适应性。

Comments 5 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12174 2026-01-21 eess.IV 67%

A multitask framework for automated interpretation of multi-frame right upper quadrant ultrasound in clinical decision support

多任务框架用于临床决策支持中多帧右上象限超声自动解读

Haiman Guo, Cheng-Yi Li, Yuli Wang, Robin Wang, Yuwei Dai, Qinghai Peng, Danming Cao, Zhusi Zhong, Thao Vu, Linmei Zhao, Chengzhang Zhu, Christopher Tan, Jacob Schick, Stephen Kwak, Farzad Sedaghat, Javad Azadi, James Facciola, Jonathan Feng, Dilek Oncel, Ulrike Hamper, Alex Zhu, Tej Mehta, Melissa Leimkuehler, Cheng Ting Lin, Zhicheng Jiao, Ihab Kamel, Jing Wu, Li Yang, Harrison Bai

专题命中 规划决策 :agent(abstract);workflow(abstract)

AI总结 本文提出多任务视觉-语言模型,用于提升右上象限超声波解读的诊断准确性与手术决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13897 2026-01-21 cs.LG cs.AI 62%

TractRLFusion: A GPT-Based Multi-Critic Policy Fusion Framework for Fiber Tractography

TractRLFusion:基于GPT的多批评者策略融合框架用于纤维追踪

Ankita Joshi, Ashutosh Sharma, Anoushkrit Goel, Ranjeet Ranjan Jha, Chirag Ahuja, Arnav Bhavsar, Aditya Nigam

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 TractRLFusion基于GPT提出多批评者策略融合框架,通过数据驱动方法提升纤维追踪的准确性和解剖可靠性。

Comments Accepted at 23rd IEEE International Symposium on Biomedical Imaging (ISBI), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13422 2026-01-21 cs.LG cs.AI 62%

TrustEnergy: A Unified Framework for Accurate and Reliable User-level Energy Usage Prediction

TrustEnergy:一种用于准确可靠用户层面能源使用预测的统一框架

Dahai Yu, Rongchao Xu, Dingyi Zhuang, Yuheng Bu, Shenhao Wang, Guang Wang

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 TrustEnergy通过分层时空表示和顺序符合化分位数回归模块,提升用户层面能源使用预测的准确性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10512 2026-01-21 cs.CV cs.AI cs.LG 62%

SatMap: Revisiting Satellite Maps as Prior for Online HD Map Construction

SatMap: 重新审视卫星地图作为在线高精度地图构建的先验条件

Kanak Mazumder, Fabian B. Flohr

机构 * Munich University of Applied Sciences(慕尼黑应用科学大学) Intelligent Vehicles Lab (IVL) Munich(慕尼黑智能车辆实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 SatMap通过整合卫星地图与多视角摄像头观测,提升在线高精度地图构建的性能和鲁棒性。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00377 2026-01-21 cs.CV cs.AI cs.LG cs.RO 62%

Shape Completion with Prediction of Uncertain Regions

形状补全与不确定区域预测

Matthias Humt, Dominik Winkelbauer, Ulrich Hillenbrand

机构 * DLR Institute of Robotics and Mechatronics(德国航空航天中心机器人与机电研究所) Technical University of Munich(慕尼黑技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出两种新颖方法用于预测不确定区域,以提升形状补全和抓取质量,通过后处理和直接预测不确定性指标,优于现有基线方法。

Comments 7 pages, 5 figures, Published in IROS 2023. Project page: https://hummat.github.io/2023-iros-uncertain/

Journal ref in Proc. 2023 IEEE/RSJ Int. Conf. on Intelligent Robots and Systems (IROS), Detroit, MI, USA, Oct. 2023, pp. 1215-1221

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12842 2026-01-21 cs.AI cs.LG 62%

SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning

SCULPT:基于约束的剪枝MCTS,为数学推理 carve 高效路径

Qitong Fang, Haotian Li, Xu Wang

机构 * Jilin Jianzhu University(吉林建筑大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 SCULPT通过引入约束引导的剪枝MCTS方法,提升数学推理的效率和准确性,同时保持稳定性。

Comments 11 pages, 3 figures. Equal contribution: Qitong Fang and Haotian Li. Corresponding authors: Qitong Fang (fangqitong@student.jlju.edu.cn), Haotian Li (lihaotian@student.jlju.edu.cn), Xu Wang (wangxu@jlju.edu.cn)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10101 2026-01-21 cs.AI cs.CL 62%

Matrix as Plan: Structured Logical Reasoning with Feedback-Driven Replanning

矩阵作为计划:基于反馈驱动的重计划的结构化逻辑推理

Ke Chen, Jiandian Zeng, Zihao Peng, Guo Li, Guangxue Zhang, Tian Wang

机构 * Faculty of Arts and Sciences(艺术与科学学院) Beijing Normal University(北京师范大学) Institute of Artificial Intelligence and Future Networks(人工智能与未来网络研究所) Engineering Research Center of Cloud-Edge Intelligent Collaboration on Big Data, Ministry of Education(教育部云-边智能协同大数据工程研究中心)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 MatrixCoT通过引入矩阵基础计划和反馈驱动重计划机制,提升LLM在复杂符号推理任务中的鲁棒性和可解释性。

Comments 12 pages, 5 figures, 2 tables. Accepted at The Web Conference (WWW) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07260 2026-01-21 cs.AI cs.LG 62%

PADiff: Predictive and Adaptive Diffusion Policies for Ad Hoc Teamwork

PADiff: 预测性与自适应扩散策略用于即兴团队合作

Hohei Chan, Xinzhi Zhang, Antao Xiang, Weinan Zhang, Mengchen Zhao

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 PADiff通过整合队友预测信息,提升在非平稳即兴团队合作场景中的预测与适应能力,实现多模态协作模式的多样化。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09219 2026-01-21 cs.LG cs.AI 62%

Vejde: A Framework for Inductive Deep Reinforcement Learning Based on Factor Graph Color Refinement

Vejde:基于因子图着色细化的归纳式深度强化学习框架

Jakob Nyberg, Pontus Johnson

机构 * Division of Network and Systems Engineering(网络与系统工程系) KTH Royal Institute of Technology(皇家理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 Vejde通过结合数据抽象、图神经网络和强化学习,实现对复杂状态决策问题的归纳式策略生成,展示了其在多个任务域中的泛化能力。

Journal ref Transactions on Machine Learning Research, January 2026

详情

展开后加载摘要…

URL PDF HTML 收藏