arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-11-21 至 2025-11-21 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 14 篇

2511.16635 2025-11-21 cs.CV cs.CL 87%

SurvAgent: Hierarchical CoT-Enhanced Case Banking and Dichotomy-Based Multi-Agent System for Multimodal Survival Prediction

SurvAgent: 基于层次化CoT增强的案例库与二元多智能体系统用于多模态生存预测

Guolin Huang, Wenting Chen, Jiaqi Yang, Xinheng Lyu, Xiaoling Luo, Sen Yang, Xiaohan Xing, Linlin Shen

机构 * Shenzhen University(深圳大学) Stanford University(斯坦福大学) University of Nottingham Ningbo China(诺丁汉大学宁波分校) Ant Group(蚂蚁集团)

专题命中 规划推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);planning(abstract)

AI总结 SurvAgent通过层次化CoT增强的多智能体系统,整合多模态数据,提升生存预测的可解释性与准确性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16333 2025-11-21 cs.LG 83%

Beyond Generative AI: World Models for Clinical Prediction, Counterfactuals, and Planning

超越生成式AI:用于临床预测、反事实和规划的世界模型

Mohammad Areeb Qazi, Maryam Nadeem, Mohammad Yaqub

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(莫莫德·本·扎伊德人工智能大学)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract);分类 cs.LG

AI总结 本文探讨了世界模型在医疗领域中的应用,旨在通过预测动态、反事实评估和规划提升临床决策的可靠性。

Comments 2 Figures, 1 Table

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06190 2025-11-21 cs.CL 83%

Confidence-Guided Stepwise Model Routing for Cost-Efficient Reasoning

基于置信度的分步模型路由用于高效推理

Sangmook Lee, Dohyung Kim, Hyukhun Koh, Nakyeong Yang, Kyomin Jung

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.CL

AI总结 STEER通过利用模型内部置信度实现高效的模型路由,减少推理成本并提升准确性。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08546 2025-11-21 cs.RO 82%

Grounding LLMs For Robot Task Planning Using Closed-loop State Feedback

通过闭环状态反馈接地LLMs用于机器人任务规划

Vineet Bhat, Ali Umut Kaypak, Prashanth Krishnamurthy, Ramesh Karri, Farshad Khorrami

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 本文提出BrainBody-LLM方法,通过闭环反馈机制提升LLMs在机器人任务规划中的鲁棒性,实现在复杂任务中的显著性能提升。

Comments Preprint version. Accepted full paper available here: https://advanced.onlinelibrary.wiley.com/doi/10.1002/adrr.202500072

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07686 2025-11-21 cs.RO 78%

Risk Map As Middleware: Towards Interpretable Cooperative End-to-end Autonomous Driving for Risk-Aware Planning

风险地图作为中间件:迈向风险感知的可解释协作端到端自动驾驶

Mingyue Lei, Zewei Zhou, Hongchen Li, Jiaqi Ma, Jia Hu

机构 * Key Laboratory of Road and Traffic Engineering of the Ministry of Education, Tongji University(教育部道路与交通工程重点实验室,同济大学) UCLA Mobility Lab, University of California, Los Angeles(加州大学洛杉矶分校UCLA移动实验室)

专题命中 规划推理 :planning(title,abstract)

AI总结 本文提出RiskMM框架,通过风险地图中间件提升自动驾驶的可解释性和风险感知规划能力。

Comments IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00588 2025-11-21 cs.LG cs.AI cs.CY 73%

Diagnosing Hallucination Risk in AI Surgical Decision-Support: A Sequential Framework for Sequential Validation

诊断人工智能手术决策支持中的幻觉风险:一种用于序列验证的连续框架

Dong Chen, Yanzhe Wei, Zonglin He, Guan-Ming Kuang, Canhua Ye, Meiru An, Huili Peng, Yong Hu, Huiren Tao, Kenneth MC Cheung

机构 * Orthopaedic Centre, The University of Hong Kong - Shenzhen Hospital(香港大学深圳医院骨科中心) Translational Medicine Centre, The University of Hong Kong - Shenzhen Hospital(香港大学深圳医院转化医学中心) Department of Orthopaedics & Traumatology, Li Ka Shing Faculty of Medicine, The University of Hong Kong(香港大学李嘉诚医学院骨科与创伤外科部)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文提出了一种用于评估人工智能手术决策支持系统幻觉风险的连续框架,通过多维度测试揭示模型在复杂性下的脆弱性,并强调了增强推理能力的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11277 2025-11-21 cs.AI cs.MA 70%

Taming Uncertainty via Automation: Observing, Analyzing, and Optimizing Agentic AI Systems

通过自动化控制不确定性:观察、分析和优化代理AI系统

Dany Moshkovich, Sergey Zeltyn

机构 * IBM Research(IBM研究)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出AgentOps框架,通过自动化管理代理AI系统的不确定性,实现安全、适应性和有效性的运营。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04420 2025-11-21 cs.LG cs.AI cs.CL 67%

KVTuner: Sensitivity-Aware Layer-Wise Mixed-Precision KV Cache Quantization for Efficient and Nearly Lossless LLM Inference

KVTuner: 一种面向层间敏感性的混合精度KV缓存量化方法,用于高效且接近无损的LLM推理

Xing Li, Zeyu Xing, Yiming Li, Linping Qu, Hui-Ling Zhen, Wulong Liu, Yiwu Yao, Sinno Jialin Pan, Mingxuan Yuan

机构 * Huawei Noah's Ark Lab(华为诺亚实验室) The Chinese University of Hong Kong(香港中文大学) Huawei Computing Product Line(华为计算产品线)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 KVTuner通过多目标优化实现高效且接近无损的LLM推理,适用于不同模型和约束条件。

Comments Accepted by ICML25. Code: https://github.com/cmd2001/KVTuner

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02054 2025-11-21 cs.RO cs.AI cs.CV cs.LG 62%

RAPID: Robust and Agile Planner Using Inverse Reinforcement Learning for Vision-Based Drone Navigation

RAPID: 基于逆强化学习的鲁棒且敏捷规划器用于基于视觉的无人机导航

Minwoo Kim, Geunsik Bae, Jinwoo Lee, Woojae Shin, Changseung Kim, Myong-Yol Choi, Heejung Shin, Hyondong Oh

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于逆强化学习的无人机高速视觉导航规划器,通过减少环境交互和提升鲁棒性,实现复杂环境中的敏捷飞行。

Comments 18 pages, 11 figures, 58 references, and appendix is included

Journal ref Proceedings of Robotics: Science and Systems (RSS), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06017 2025-11-21 cs.CL 57%

AgentSwift: Efficient LLM Agent Design via Value-guided Hierarchical Search

AgentSwift: 通过价值引导的分层搜索高效设计LLM代理

Yu Li, Lehui Li, Zhihao Wu, Qingmin Liao, Jianye Hao, Kun Shao, Fengli Xu, Yong Li

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 AgentSwift通过价值引导的分层搜索高效设计LLM代理,实现8.34%的性能提升。

Comments AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16005 2025-11-21 cs.SE cs.AI 57%

InfCode-C++: Intent-Guided Semantic Retrieval and AST-Structured Search for C++ Issue Resolution

InfCode-C++: 基于意图的语义检索与AST结构化搜索用于C++问题解决

Qingao Dong, Mengfei Wang, Hengzhi Zhang, Zhichao Li, Yuan Yuan, Mu Li, Xiang Gao, Hailong Sun, Chunming Hu, Weifeng Lv

机构 * Beihang University(北航) Beijing Tokfinity Technology Co., Ltd.(北京 Tokfinity 技术有限公司)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 INFCODE-C++ 是首个针对 C++ 的自主系统,通过结合语义代码意图检索和 AST 结构查询,实现端到端的问题解决,其性能显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16243 2025-11-21 cs.CY 50%

An Agent-Based Simulation of Regularity-Driven Student Attrition: How Institutional Time-to-Live Constraints Create a Dropout Trap in Higher Education

基于常规驱动的学生流失的代理模拟:机构时间到寿命限制如何在高等教育中创造辍学陷阱

H. R. Paz

专题命中 规划推理 :planning(abstract)

AI总结 本文通过代理模拟揭示了行政时间限制如何导致学生辍学,指出规范机制比单纯学术失败更驱动辍学,挑战了行政结构的中立性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15852 2025-11-21 cs.SE 50%

AI-Enabled Orchestration of Event-Driven Business Processes in Workday ERP for Healthcare Enterprises

基于人工智能的事件驱动业务流程编排在Workday ERP中的应用

Monu Sharma

专题命中 规划推理 :planning(abstract)

AI总结 本研究提出基于人工智能的事件驱动编排框架,用于提升Workday ERP在医疗行业中的流程效率、成本可见性和决策准确性。

Comments 10 Pages, 6 figures , 2 Tables

Journal ref https://www.ijcnis.org/index.php/ijcnis/article/view/8639,2025 , 11

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13910 2025-11-21 cs.HC cs.ET 50%

Enhancing Decision Support in Construction through Industrial AI

通过工业AI增强建筑决策支持

Parul Khanna, Sameer Prabhu, Ramin Karim, Phillip Tretten

专题命中 规划推理 :planning(abstract)

AI总结 本研究通过探索建筑行业AI解决方案的关键因素,旨在提升决策支持、可使用性和AI解决方案的采用。

详情

展开后加载摘要…

URL PDF HTML 收藏