arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45515 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 11120 篇

2605.22681 2026-07-21 cs.AI 版本更新 79%

Scientific reasoning does not reliably translate into scientific forecasting in frontier AI

用人工智能预测科学进步

Sean Wu, Pan Lu, Yupeng Chen, Jonathan Bragg, Yutaro Yamada, Peter Clark, David Clifton, Philip Torr, James Zou, Junchi Yu

机构 * University of Oxford(牛津大学) Stanford University(斯坦福大学) Allen Institute for AI(人工智能研究所) Sakana AI

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文研究了人工智能在预测科学进步中的能力,提出了一种基于时间的评估框架,并介绍了CUSP基准,通过可行性评估、机制推理、生成性解决方案设计和时间预测来评估AI系统的科学预测能力,发现当前前沿模型在不同领域存在系统性限制,且预测结果受事件发生时间影响较大,表明AI在科学预测中仍存在不足。

Comments 62 pages, 14 figures, 25 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18645 2026-07-17 cs.LG 版本更新 79%

Adaptive Time Series Reasoning via Segment Selection

通过片段选择的自适应时间序列推理

Shvat Messica, Jiawen Zhang, Kevin Li, Theodoros Tsiligkaridis, Marinka Zitnik

机构 * harvard(哈佛大学) mit(麻省理工学院) mitll(MIT林肯实验室) hongkong(香港科学与技术大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 提出ARTIST框架,将时间序列推理建模为序列决策问题,通过控制器-推理器架构和强化学习自适应选择信息片段,提升推理准确率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11811 2026-07-16 cs.RO cs.AI cs.CV 版本更新 79%

RADAR: Closed-Loop Robotic Data Generation via Semantic Planning and Autonomous Causal Environment Reset

RADAR: 通过语义规划和自主因果环境重置实现闭环机器人数据生成

Yongzhong Wang, Keyu Zhu, Yong Zhong, Liqiong Wang, Jinyu Yang, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Spatialtemporal AI(时空人工智能)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 RADAR通过语义规划和自主因果环境重置实现闭环机器人数据生成,具备高适应性和可扩展性,在仿真和现实部署中均表现出卓越的性能。

Comments 8 pages, 4 figures. Accepted to the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). Project page: https://radar-iros.netlify.app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19186 2026-07-15 cs.RO cs.AI cs.FL 版本更新 79%

Real-Time Model Checking for Closed-Loop Robot Reactive Planning

闭环机器人反应式规划的实时模型检查

Christopher Chandler, Bernd Porr, Giulia Lafratta, Alice Miller

机构 * School of Computing Science University of Glasgow Glasgow Scotland UK(计算科学学院格拉斯哥大学格拉斯哥苏格兰英国) School of Biomedical Engineering University of Glasgow Glasgow Scotland UK(生物医学工程学院格拉斯哥大学格拉斯哥苏格兰英国) University of Glasgow(格拉斯哥大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 研究利用模型检查让自主机器人实现反应式多步规划与避障,特制算法基于生物知识实时原位生成规划,通过链式系统和临时快照减轻状态空间爆炸,实验证明方法有效且性能提升,为自动驾驶导航发展提供案例,适用于关键任务移动机器人。

Comments 41 pages excluding references, 21 figures, submitted to Formal Aspects of Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11358 2026-07-14 cs.CL 新提交 79%

RefineEvo: Planning-Guided Heuristic Evolution with Bidirectional Experience

RefineEvo:基于双向经验的规划引导启发式进化

Yang Wu, Junran Pan, Yifan Zhang, Ning Xu, Fanshuo Zeng, Jian Cheng

机构 * C$^2$DL, Institute of Automation, Chinese Academy of Sciences(C2DL,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences, Beijing(人工智能学院,中国科学院大学,北京) University of Chinese Academy of Sciences, Nanjing(中国科学院大学,南京)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 针对自动启发式设计中基于LLM方法的不足,提出RefineEvo框架,通过规划器和反射器,结合双向经验池动态调度进化算子,在经典组合优化基准测试中表现出色,提升了解质量和令牌效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10651 2026-07-14 cs.AI 新提交 79%

Embark Now: User Demand Oriented Framework for Multi-day Urban Travel Itinerary Planning

即刻出发:面向多日城市旅行行程规划的用户需求导向框架

Rongbo Qi, Yaqi Zhang, Shijun Yan, Xuemeng Liu, Xiangrui Cai, Chunyao Song

机构 * Jiangxi Normal University(江西师范大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 针对大城市多日旅行行程规划难题,提出集成大语言模型与增强GRASP算法的框架,经实验验证其在行程质量和计算效率上显著优于现有方法,能动态满足多样用户需求。

Comments 37 pages, 16 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10630 2026-07-14 cs.RO cs.AI 新提交 79%

World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning

作为对手的世界模型:用于鲁棒运动规划的多智能体自我博弈微调

Tong Nie, Yuewen Mei, Junlin He, Yihong Tang, Jian Sun, Wei Ma

机构 * The Hong Kong Polytechnic University(香港理工大学) Tongji University(同济大学) McGill University(麦吉尔大学) Mila-Quebec AI Institute(米拉-魁北克人工智能研究所)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 研究在密集交通中自动驾驶车辆鲁棒运动规划问题,提出对抗世界建模(AWM)框架,通过多智能体自我博弈微调,引入解耦求解器,经实验验证该方法能生成可转移对抗交互,使规划器在多种场景有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10411 2026-07-14 cs.SE cs.AI 新提交 79%

Mitigating LLM Sycophancy in Code Smell Detection Using Evidence-Guided Reasoning Prompts

使用证据引导推理提示减轻代码异味检测中的大语言模型谄媚现象

Istiaq Ahmed Fahad, Kamruzzaman Asif, Md. Nurul Ahad Tawhid

机构 * Institute of Information Technology(信息科技研究所) University of Dhaka(达卡大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究基于LLM的代码异味检测中谄媚偏差问题,通过MLCQ数据集评估不同提示框架影响,发现模型对提示变化敏感。提出证据引导去偏提示策略,降低决策不稳定性,提高鲁棒性,为解决该问题提供有效方法。

Comments 11 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09452 2026-07-13 cs.SE cs.AI 新提交 79%

Practical Source Code Recovery from Binary Functions Using Anchor-Based Retrieval and LLM Reasoning

使用基于锚点的检索和大语言模型推理从二进制函数中进行实用的源代码恢复

Charles Edward Gagnon, Steven H. H. Ding, Philippe Charland, Benjamin C. M. Fung

机构 * McGill University(麦吉尔大学) Defence Research and Development Canada(国防研究与发展加拿大)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究如何从二进制函数恢复源代码,结合逆向工程、基于锚点检索和大语言模型推理,在基于高保真数据库对tcpdump二进制文件评估中,匹配方法实现95.2%汇编指令覆盖率,在GitHub数据库实验中平均覆盖率35.5%。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08602 2026-07-10 cs.AI 新提交 79%

Towards Precision Therapy in Hepatocellular Carcinoma: A Clinical-Reasoning LLM for Risk Stratification and Treatment Guidance

迈向肝细胞癌的精准治疗:用于风险分层和治疗指导的临床推理大语言模型

Peng Cui, Jitao Wang, Siyan Xue, Yao Huang, Haoming Xia, Dong Li, Dengxiang Liu, Weilin Wang, Liping Liu, Leida Zhang, Yunfu Cui, Tao Peng, Daolin Ji, Haitao Zhao, Wei Zhang, Xiaojuan Wang, Weijie Ma, Zongren Ding, Jinlong Li, Yuan Ding, Jiajing Zhao, Zhiyu Chen, Chengkun Yang, Ziyue Huang, Jiaqi Liu, Fusheng Liu, Yang Zhou, Xiaojuan Wang, Zhongquan Sun, Shiyun Bao, Xiaojun Wang, Ming Yang, Guangxin Li, Bin Shu, Yong Liao, Hongxuan Li, Yao Tang, Shizhong Yang, Yongyi Zeng, Yufeng Yuan, Yinpeng Dong, Jihui Hao, Jun Zhu, Jiahong Dong

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究针对肝细胞癌治疗问题,提出HCC-STAR临床推理大语言模型。通过处理电子病历叙述输出风险分层、治疗方案等。经多中心队列验证,性能领先,能助医生决策,是可靠的肝细胞癌风险分层和精准治疗决策支持系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05622 2026-07-10 cs.CL 版本更新 79%

AdaPlanBench: Evaluating Adaptive Planning in Large Language Model Agents under World and User Constraints

AdaPlanBench: 在世界约束和用户约束下评估大语言模型智能体的自适应规划能力

Jiayu Liu, Cheng Qian, Zhenhailong Wang, Bingxuan Li, Jiateng Liu, Qing Zong, Heng Wang, Jeonghwan Kim, Yumeng Wang, Bingxiang He, Xiusi Chen, Yi R. Fung, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 针对现有基准未充分探索渐进揭示的双重约束下的自适应规划问题,提出动态交互基准AdaPlanBench,通过307个家务任务和可扩展的约束构建流程,评估LLM智能体在交互中根据反馈迭代调整计划的能力。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06964 2026-07-09 cs.RO cs.AI 新提交 79%

End-to-End LLM Flight Planning with RAG-based Memory and Multi-modal Coach Agent

基于基于检索增强生成的记忆和多模态教练代理的端到端大语言模型飞行规划

Amin Tabrizian, Arsyi Aziz, Aarifah Ullah, Mahyar Ghazanfari, Pouria Razzaghi, Peng Wei

机构 * George Washington University(乔治华盛顿大学) Metis Solutions Technology Inc

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 针对电动垂直起降飞机部署中传统飞行规划算法难以融入人类偏好的问题,提出FRAMe工具,集成规划器LLM、多模态教练代理和基于RAG的记忆,在多场景演示中效果最佳,能将自然语言指令转化为优质飞行路线。

Comments Accepted at the ICML 2026 LM4Plan Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18784 2026-07-09 cs.AI 版本更新 79%

Successor-Generator Planning with LLM-generated Heuristics

基于大语言模型生成启发式策略的后继生成器规划

Alexander Tuisov, Yonatan Vernik, Alexander Shleyfman

机构 * Computer Science Department, Bar-Ilan University(巴伊兰大学计算机科学系)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 研究借助大语言模型,从规划任务中生成特定问题启发式函数并集成到搜索算法。该方法在多规划基准测试中性能优异,还能解决传统形式难表达的问题,经评估展现出有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06326 2026-07-08 cs.AI 新提交 79%

DT-Guard: Intent-Driven Reasoning-Active Training for Reasoning-Free LLM Safety Guardrail

DT-Guard:用于无推理语言模型安全护栏的意图驱动推理主动训练

He Liu, Changtao Miao, Xinjie Yang, Tianle Song, Yin Wu, Junchi Chen, Bintao He, Xinyuan Zhang, Bo Zhang, Shi Yan, Wei Lu, Wei Wang, Danyang Xu, Jiansheng Cai, Zhe Li

机构 * Ant Group(蚂蚁集团)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究为开放世界应用的语言模型设计安全护栏的问题,提出基于推理主动训练、无推理推理范式的DT-Guard模型,通过构建意图驱动数据集等方法提升性能,实验证明其在安全基准测试中表现优异,能有效将推理监督内化到低延迟安全判别中。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04906 2026-07-07 cs.LG 新提交 79%

RL-Ballast: Ship Ballast Water Path Planning and Clog Prediction via Reinforcement Learning

RL-Ballast:通过强化学习进行船舶压载水路径规划和堵塞预测

Ming-Kuan Lin, Yi-Chung Lai, Ming-Hsin Chiang, Tsung-Wei Pan, Jung-Hua Wang

机构 * National Taiwan Ocean University(台湾海洋大学) AI Research Center(人工智能研究中心) Shinsoft Corporation(Shinsoft公司) Department of Electrical Engineering(电子工程系)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 针对船舶压载水控制问题,提出基于图的深度强化学习框架RL-Ballast,将阀门排列问题转化为可行路径,利用堆叠水箱水位等近似部分可观测环境,能自适应规划路径并进行堵塞诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04124 2026-07-07 cs.RO cs.AI 新提交 79%

Conflict-Based Lazy Search for Fast Multi-Manipulator Planning

基于冲突的懒搜索用于快速多机器人规划

Dongliang Zheng, Zhipeng Wang, Siqi Wang, Yuxi Lu, Bin He, Hesheng Wang, Panagiotis Tsiotras

机构 * Shanghai Research Institute for Intelligent Autonomous Systems, Shanghai Institute of Intelligent Science and Technology, the State Key Laboratory of Autonomous Intelligent Unmanned Systems, and Frontiers Science Center for Intelligent Autonomous Systems of Ministry of Education, Tongji University(上海智能无人系统科学中心,上海智能科学与技术研究院,自主智能无人系统国家重点实验室,同济大学智能自主系统前沿科学中心) Department of Automation, Shanghai Jiao Tong University(上海交通大学自动化系) School of Aerospace Engineering and Institute for Robotics and Intelligent Machines, Georgia Institute of Technology(佐治亚理工学院航空航天工程学院和机器人与智能机器研究所)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 针对多机器人在杂乱工作空间的实时规划难题,提出基于冲突的懒搜索(CBLS)算法。该算法基于CBS,通过预计算和懒搜索改进,采用懒评估图与LEA*算法,应用于多机器人规划问题,性能优于CBS和RRT-Connect。

Journal ref IEEE/ASME Transactions on Mechatronics(TMECH) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03748 2026-07-07 cs.AI 新提交 79%

Bridging Interleaved Multi-Modal Reasoning as a Unified Decision Process

将交错多模态推理作为统一决策过程进行衔接

Zican Hu, Xuyang Hu, Yiming Liu, Zuwei Long, Wei Liu, Yunzhuo Hao, Jiawei Gu, Linjie Li, Yu Cheng, Zhenhong Sun, Weibo Gu, Xing Sun, Zhi Wang

机构 * Nanjing University(南京大学) Tencent Youtu Lab(腾讯优图实验室) Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Washington(华盛顿大学) The Chinese University of Hong Kong(香港中文大学) Australian National University(澳大利亚国立大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究统一多模态模型中强化学习优化多轮生成的问题,提出BRAID框架,将文本-图像-文本推理视为统一马尔可夫决策过程,通过单一强化学习目标联合优化文本和视觉生成,实验表明该框架性能优于基线。

Comments 22 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02927 2026-07-07 cs.CV cs.AI 新提交 79%

VideoSearcher: Empowering Video Deep Research with Multi-Tool Agentic Reasoning via Reinforcement Learning

VideoSearcher:通过强化学习利用多工具智能推理助力视频深度研究

Zhenkun Gao, Yicheng Bao, Jinlong Peng, Xueheng Li, Theo Huang, Bangwei Liu, Kunquan Li, Zhenye Gan, Tao Hu, Chengjun Xie, Mingqian Yang, Xuanhua He, Zhizhong Zhang, Xin Tan, Chengjie Wang, Yuan Xie

机构 * Stephengzk

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 针对视频理解局限,提出VideoSearcher框架,统一多任务于单推理轨迹,用强化学习算法BiSPO优化推理轨迹,构建新基准,实验表明其在多基准中显著优于开源基线。

Comments Technical report. Project page: https://stephen-gzk.github.io/VideoSearcher-website/ ; Code: https://github.com/Stephen-gzk/VideoSearcher ; Model & Data on HuggingFace

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29563 2026-07-07 cs.AI cs.CV cs.RO 版本更新 79%

Planning with the Views

通过场景自我探索进行视图规划

Kangrui Wang, Linjie Li, Zhengyuan Yang, Shiqi Chen, Zihan Wang, Li Fei-Fei, Jiajun Wu, Leonidas Guibas, Lijuan Wang, Manling Li

机构 * Northwestern University(西北大学) University of Washington(华盛顿大学) Microsoft(微软) University of Oxford(牛津大学) Stanford University(斯坦福大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出ViewSuite基准测试揭示VLM在多步视图规划中的不足,并设计迭代框架通过自我探索和视图图蒸馏将Qwen2.5-VL-7B的交互式视图规划准确率从2.5%提升至47.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16512 2026-07-07 cs.AI 版本更新 79%

Framework of Thoughts: A Foundation Framework for Dynamic and Optimized Reasoning based on Chains, Trees, and Graphs

思维框架:基于链、树和图的动态优化推理基础框架

Felix Fricke, Simon Malberg, Georg Groh

机构 * School of Computation, Information and Technology(计算、信息与技术学院) Technical University of Munich(慕尼黑技术大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究针对现有思维提示方案的局限,提出通用基础框架FoT,内置超参调整等功能,通过在其中实现三种流行方案验证其能力,能加快执行、降低成本并获更好任务分数,还发布代码库促进相关推理方案发展。

Comments Published at SURGeLLM 2026, ACL 2026. Camera-ready version

Journal ref Proceedings of the First Workshop on Structured Understanding, Retrieval, and Generation in the LLM Era (SURGeLLM 2026), pp. 132-151, Association for Computational Linguistics, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01942 2026-07-03 cs.AI 新提交 79%

Atomic Task Graph: A Unified Framework for Agentic Planning and Execution

原子任务图:智能体规划与执行的统一框架

Yue Zhang, Sihan Chen, Ziwen Huang, Hanyun Cui, Kangye Ji, Zhi Wang

机构 * South China University of Technology(华南理工大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出原子任务图(ATG)框架,通过显式图结构暴露子任务依赖、支持并行执行和局部错误修复,在三个交互基准上使用7B-8B模型显著提升成功率和执行效率。

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01440 2026-07-03 cs.CL 新提交 79%

FaithMed: Training LLMs For Faithful Evidence-Based Medical Reasoning

FaithMed: 训练大语言模型进行忠实于证据的医学推理

Zhiyun Zhang, Liwen Sun, Xiang Qian, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University School of Medicine(斯坦福大学医学院) Xlue

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出FaithMed框架,通过过程级奖励和优势分组强化学习,监督LLM在医学推理中忠实评估和应用检索证据,在7个基准上平均提升9%。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15588 2026-07-03 cs.CL 版本更新 79%

YuFeng-XGuard: A Reasoning-Centric, Interpretable, and Flexible Guardrail Model for Large Language Models

YuFeng-XGuard:一种以推理为中心、可解释且灵活的大语言模型护栏模型

Junyu Lin, Meizhen Liu, Xiufeng Huang, Jinfeng Li, Haiwen Hong, Xiaohan Yuan, Yuefeng Chen, Longtao Huang, Hui Xue, Ranjie Duan, Zhikai Chen, Yuchuan Fu, Defeng Li, Lingyao Gao, Yitong Yang

机构 * Alibaba-AAIG(阿里云-阿里人工智能研究院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL

AI总结 提出YuFeng-XGuard护栏模型系列,通过结构化风险预测(含风险类别、置信度分数及自然语言解释)实现可解释的多维风险感知,并采用分层推理范式平衡延迟与解释深度,同时引入动态策略机制解耦风险感知与策略执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00147 2026-07-02 cs.AI 新提交 79%

RareDxR1: Autonomous Medical Reasoning for Rare Disease Diagnosis Beyond Human Annotation

RareDxR1:超越人类标注的罕见病诊断自主医学推理

Deyang Jiang, Haoran Wu, Ziyi Wang, Yiming Rong, Yunlong Zhao, Ye Jin, Bo Xu

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出端到端推理大模型RareDxR1,通过知识内化与自主进化学习框架,结合反思增强推理采样和双级课程强化学习,直接从非结构化临床笔记诊断罕见病,无需依赖结构化表型或人类标注,在多个基准上达到最先进准确率。

Comments 7 pages, 3 figures. Accepted to IEEE International Conference on Multimedia and Expo (ICME) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31800 2026-07-01 cs.AI 新提交 79%

Evo-PI: Aligning Medical Reasoning via Evolving Principle-Guided Supervision

Evo-PI:通过演化原则引导的对齐医学推理

Xianda Zheng, Huan Gao, Meng-Fen Chiang, Michael Witbrock, Kaiqi Zhao, Shangyang Li

机构 * School of Computer Science, University of Auckland(奥克兰大学计算机科学学院) Beijing University of Posts and Telecommunications(北京邮电大学) Renyixun Health Technology Co., Ltd.(仁医讯健康科技有限公司) National Yang Ming Chiao Tung University(国立阳明交通大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出Evo-PI框架,将推理原则作为可演化的语言监督信号,通过协同进化循环动态调整模型推理,在医学视觉问答中提升准确率最高达24.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31599 2026-07-01 cs.CV cs.AI 新提交 79%

Token-Sparse Medical Multimodal Reasoning via Dual-Stream Reinforcement Learning

通过双流强化学习实现令牌稀疏的医学多模态推理

Kaitao Chen, Weiqian Zhao, Jiamin Wu, Qihao Zheng, Shangquan Sun, Chunfeng Song, Xiaosong Wang, Mu Zhou, Mianxin Liu

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出双流强化学习框架ViToS,通过主动视觉令牌剪枝实现令牌稀疏的医学多模态推理,在七个医学基准上减少77%令牌并提升性能。

Comments ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31073 2026-07-01 cs.AI cs.MA cs.RO 新提交 79%

MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning

MultiUAV-Plat:面向多无人机协同任务规划的LLM平台、基准测试与框架

Sheng Zhang, Qinglin Li, Yuechao Zang, Xueqin Huang, Yijia Fu, Cheng Zhu

机构 * National Key Laboratory of Information Systems Engineering, National University of Defense Technology(国防科技大学信息系统工程国家重点实验室)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出MultiUAV-Plat平台与基准测试,以及Agent4Drone框架,通过LLM驱动的工具交互实现多无人机协同任务规划,在任务通过率等指标上显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30694 2026-07-01 cs.RO cs.AI 新提交 79%

DSIP: A Dynamic Coordination Planner for Signal-Free Intersections using Diffusion-Model-Based Multi-Agent Motion Planning

DSIP: 基于扩散模型的多智能体运动规划的无信号交叉口动态协调规划器

Qian Hu, Haoyang Peng, Songan Zhang, Ming Yang, Hongtei Eric Tseng

机构 * Global Institute of Future Technology, Shanghai Jiao Tong University(上海交通大学全球未来技术学院) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院) Department of Electrical Engineering, The University of Texas at Arlington(德克萨斯大学阿灵顿分校电气工程系)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 提出DSIP框架,利用扩散模型生成多车连续轨迹优化,替代传统信号相位控制,在SUMO仿真中显著降低平均延误并提高平均速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29150 2026-06-30 cs.AI 79%

Flow Reasoning Models: Scaling Reasoning Through Iterative Self-Refinement

流推理模型:通过迭代自我精炼扩展推理能力

Alec Helbling, Andrey Bryutkin, Mauro Martino, Nima Dehmamy, Hendrik Strobelt

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 提出流推理模型(FRMs),利用去噪动态的稳定性作为验证器,通过测试时缩放和训练改进,高效解决数独和斑马谜题等结构化推理任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28751 2026-06-30 cs.LG cond-mat.stat-mech 79%

A Path-Space Formulation of Prediction in World Models: From a Single Action to Prediction, Planning, and Irreversibility

世界模型中预测的路径空间表述:从单一动作到预测、规划和不可逆性

Gunn Kim

机构 * Department of Physics, Sejong University, Seoul 05006, Republic of Korea(首尔大学物理系,首尔05006,韩国)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 提出世界模型中预测的路径空间表述,将预测、规划和不确定性统一为作用泛函上的操作,并发现注意力不对称性编码了数据的不可逆性。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏