arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45335 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3046 篇

2505.09862 2026-01-27 cs.HC cs.CY 50%

Rhetorical XAI: Explaining AI's Benefits as well as its Use via Rhetorical Design

修辞XAI:通过修辞设计解释AI的益处及其使用

Houjiang Liu, Yiheng Su, Matthew Lease

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出修辞XAI,通过整合logos、ethos、pathos三种修辞诉求,解决传统XAI在解释AI运作与使用价值间的设计缺口。

Comments Clarify the contextual positioning of our framework in relation to prior XAI design work and expand the review details

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13556 2026-01-21 cs.RO 50%

LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI

LogicEnvGen: 基于任务逻辑的多样化模拟环境生成用于具身AI

Jianan Wang, Siyang Zhang, Bin Li, Juan Chen, Jingtao Qi, Zhuo Zhang, Chen Qian

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院) Intelligent Game and Decision Lab (IGDL)(智能游戏与决策实验室) School of Artifical Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

专题命中 逻辑推理 :planning(abstract)

AI总结 LogicEnvGen通过任务逻辑驱动生成多样化模拟环境,提升智能体在不同环境中的适应性和鲁棒性评估性能。

Comments 19 pages, 15 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09550 2026-01-21 cs.SE 50%

Integrating Symbolic Execution with LLMs for Automated Generation of Program Specifications

将符号执行与LLMs结合以实现程序规范的自动化生成

Fanpeng Yang, Xu Ma, Shuling Wang, Xiong Xu, Qinxiang Cao, Naijun Zhan, Xiaofeng Li, Bin Gu

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出一种结合符号执行与LLMs的方法,自动生成形式化程序规范,提升程序理解与验证的精度和适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12274 2026-01-21 cs.SE 50%

Hybrid Concolic Testing with Large Language Models for Guided Path Exploration

基于大语言模型的混合协同测试用于引导路径探索

Mahdi Eslamimehr

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出一种结合大语言模型与协同执行的混合测试方法,通过引导路径探索提升程序状态空间探索效率和缺陷检测能力。

Comments 12 pages, 2 Figures, 2 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11968 2026-01-21 cs.MM cs.SD eess.AS 50%

MuseAgent-1: Interactive Grounded Multimodal Understanding of Music Scores and Performance Audio

MuseAgent-1: 交互式 grounded 多模态理解音乐谱面与表演音频

Qihao Zhao, Yunqi Cao, Yangyu Huang, Hui Yi Leong, Fan Zhang, Kim-Hui Yap, Wei Hu

机构 * Nanyang Technological University(南洋理工大学) Beijing University of Chemical Technology(北京化工大学) Microsoft(微软公司) University of Chicago(芝加哥大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 MuseAgent-1 是一个专注于音乐的多模态代理,通过结构化符号表示和多步骤推理,提升对音乐谱面和表演音频的交互式理解能力。

Comments Tech Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10865 2026-01-19 cs.CR cs.SE 50%

Multi-Agent Taint Specification Extraction for Vulnerability Detection

多代理污点规范提取用于漏洞检测

Jonah Ghebremichael, Saastha Vasan, Saad Ullah, Greg Tystahl, David Adei, Christopher Kruegel, Giovanni Vigna, William Enck, Alexandros Kapravelos

专题命中 逻辑推理 :reasoning(abstract)

AI总结 SemTaint通过结合LLM语义理解和传统静态分析,提取定制化的污点规范以提升漏洞检测效果

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05939 2026-01-12 cs.CV 50%

Context-Aware Decoding for Faithful Vision-Language Generation

面向上下文的解码方法用于忠实的视觉-语言生成

Mehrdad Fazli, Bowen Wei, Ziwei Zhu

机构 * Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出了一种无需训练的上下文嵌入注入方法,通过利用上下文嵌入信号在解码过程中保持视觉一致性,有效减少视觉-语言模型中的幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04118 2026-01-09 cs.CV 50%

GeoReason: Aligning Thinking And Answering In Remote Sensing Vision-Language Models Via Logical Consistency Reinforcement Learning

GeoReason: 通过逻辑一致性强化学习对遥感视觉-语言模型中的思考与回答进行对齐

Wenshuai Li, Xiantai Xiang, Zixiao Wen, Guangyao Zhou, Ben Niu, Feng Wang, Lijia Huang, Qiantong Wang, Yuxin Hu

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航空信息研究所) Key Laboratory of Target Cognition and Application Technology, Chinese Academy of Sciences(中国科学院目标认知与应用技术重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 GeoReason通过逻辑一致性强化学习提升遥感视觉-语言模型的推理可靠性与可解释性,实现思考与决策的同步。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03781 2026-01-08 cs.CV 50%

MVP: Enhancing Video Large Language Models via Self-supervised Masked Video Prediction

MVP: 通过自监督掩码视频预测增强视频大型语言模型

Xiaokun Sun, Zezhong Wu, Zewen Ding, Linli Xu

机构 * University of Science and Technology of China(中国科学技术大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 MVP通过自监督掩码视频预测提升视频大语言模型的时间推理和因果理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02779 2026-01-07 eess.SY cs.SY 50%

Hierarchical Preemptive Holistic Collaborative Systems for Embodied Multi-Agent Systems: Framework, Hybrid Stability, and Scalability Analysis

分层抢先整体协作系统用于具身多智能体系统:框架、混合稳定性与可扩展性分析

Ting Peng

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出分层抢先整体协作框架,通过分解全局协调问题提升具身多智能体系统的安全性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02378 2026-01-07 cs.RO 50%

Modeling the Mental World for Embodied AI: A Comprehensive Review

构建具身AI的内心世界:全面综述

Biyuan Liu, Daigang Xu, Lei Jiang, Wenjun Guo, Ping Chen

机构 * ZTE Corporation(中兴通讯公司)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文综述了具身AI中内心世界模型的研究,构建了理论框架,定义了关键组件,并分析了两种核心理论思维推理范式,以促进人机协作发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01101 2026-01-06 cs.CY 50%

An Agentic Software Framework for Data Governance under DPDP

基于DPDP的数据治理代理软件框架

Apurva Kulkarni, Chandrashekar Ramanathan

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出基于DPDP的数据治理代理框架,通过协作代理和动态政策执行实现透明、合规的数据治理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23925 2026-01-01 cs.DB 50%

Hojabr: Towards a Theory of Everything for AI and Data Analytics

Hojabr:面向人工智能和数据分析的万物理论

Amir Shaikhha

专题命中 逻辑推理 :reasoning(abstract)

AI总结 Hojabr提出了一种统一的声明式中间语言,整合了关系代数、张量代数和约束推理,以实现跨数据库系统、机器学习框架和编译器基础设施的系统推理和优化技术重用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04642 2025-12-18 math.LO 50%

Tableaux for epistemic Gödel logic

表格用于知识 Gödel 逻辑

Marta Bílková, Thomas Ferguson, Daniil Kozhemiachenko

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出了一种多智能体知识 Gödel 逻辑,利用表格计算方法解决有效性问题,证明其在不同智能体数量下的复杂性为 PSpace 或 coNP 完全。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11275 2025-12-15 cs.RO 50%

Towards Logic-Aware Manipulation: A Knowledge Primitive for VLM-Based Assistants in Smart Manufacturing

面向逻辑感知的操控:一种用于智能制造中基于VLM助手的知识原语

Suchang Chen, Daqiang Guo

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出了一种面向智能制造的基于VLM助手的知识原语,通过定义对象为中心的操控-逻辑模式,实现了在制造单元中执行复杂操控任务的逻辑感知和高效规划。

Comments 8 pages, 2 figures, submitted to the 2026 IFAC World Congress

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03421 2025-12-04 cs.SE 50%

Exploring the Potential and Limitations of Large Language Models for Novice Program Fault Localization

探索大型语言模型在初级程序员故障定位中的潜力与局限性

Hexiang Xu, Hengyuan Liu, Yonghao Wu, Xiaolan Kang, Xiang Chen, Yong Liu

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文评估了LLM在初级程序员故障定位中的性能,发现高级模型在准确性上表现优异,但存在推理过度和计算成本高等问题。

Comments The paper has been accepted for publication in The Journal of Systems & Software

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03126 2025-12-04 cs.CV 50%

Hierarchical Process Reward Models are Symbolic Vision Learners

层次化过程奖励模型是符号视觉学习者

Shan Zhang, Aotian Chen, Kai Zou, Jindong Gu, Yuan Xue, Anton van den Hengel

机构 * Adelaide AIML(阿德莱德AIML) Ohio State University(俄亥俄州立大学) University of Oxford(牛津大学) Data61 CSIRO(澳大利亚国立科研组织)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出了一种层次化过程奖励模型,通过符号学习提升图表重建、感知和推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15607 2025-12-02 cs.RO 50%

PRIMT: Preference-based Reinforcement Learning with Multimodal Feedback and Trajectory Synthesis from Foundation Models

基于偏好强化学习的多模态反馈与轨迹合成:从基础模型出发

Ruiqi Wang, Dezhong Zhao, Ziqin Yuan, Tianyu Shao, Guohua Chen, Dominic Kao, Sungeun Hong, Byung-Cheol Min

机构 * Purdue University(普渡大学) Beijing University of Chemical Technology(北京化工大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Sungkyunkwan University(成均馆大学) Indiana University Bloomington(印第安纳大学布卢明顿分校)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 PRIMT通过多模态反馈和轨迹合成,利用基础模型解决偏好强化学习中的查询模糊性和信用分配问题,提升机器人复杂行为的学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08370 2025-12-02 math.LO 50%

Encoding argumentation frameworks with set attackers to propositional logic systems

将带有集合攻击者的论证框架编码到命题逻辑系统中

Shuai Tang, Jiachao Wu, Ning Zhou

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出将带有集合攻击者的论证框架编码到命题逻辑系统中,统一了高阶AFs和SETAFs,为AI和多智能体系统提供逻辑基础。

Comments 51 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00882 2025-11-26 cs.CR 50%

VULSOLVER: Vulnerability Detection via LLM-Driven Constraint Solving

通过LLM驱动的约束求解进行漏洞检测:VULSOLVER

Xiang Li, Yueci Su, Jiahao Liu, Zhiwei Lin, Yuebing Hou, Peiming Gao, Yuanchao Zhang

专题命中 逻辑推理 :reasoning(abstract)

AI总结 VULSOLVER通过LLM驱动的约束求解方法,实现高精度漏洞检测,准确率达97.85%

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15923 2025-11-21 cs.CV 50%

RB-FT: Rationale-Bootstrapped Fine-Tuning for Video Classification

RB-FT:基于理由的视频分类微调

Meilong Xu, Di Fu, Jiaxing Zhang, Gong Yu, Jiayu Zheng, Xiaoling Hu, Dongdi Zhao, Feiyang Li, Chao Chen, Yong Cao

机构 * Stony Brook University(石溪大学) ByteDance Inc.(字节跳动公司) Harvard Medical School(哈佛医学院)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 RB-FT通过自动生成的理由提升视频分类性能,无需额外标注,有效提升模型对领域特定视频内容的理解能力。

Comments 11 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08232 2025-11-18 math.LO math.PR 50%

Two Agents, One Prompt, and Your Weight

Elchanan Mossel, Amnon Schreiber

专题命中 逻辑推理 :reasoning(abstract)

Comments Typos corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18934 2025-11-17 cs.CR 50%

Revealing Adversarial Smart Contracts through Semantic Interpretation and Uncertainty Estimation

Yating Liu, Xing Su, Hao Wu, Sijin Li, Yuxi Cheng, Fengyuan Xu, Sheng Zhong

专题命中 逻辑推理 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10649 2025-11-17 cs.MA cs.LO 50%

Towards Assume-Guarantee Verification of Abilities in Stochastic Multi-Agent Systems

Wojciech Jamroga, Damian Kurpiewski, Łukasz Mikulski

专题命中 逻辑推理 :reasoning(abstract)

Comments technical report, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04769 2025-11-10 cs.RO 50%

ReGen: Generative Robot Simulation via Inverse Design

Phat Nguyen, Tsun-Hsuan Wang, Zhang-Wei Hong, Erfan Aasi, Andrew Silva, Guy Rosman, Sertac Karaman, Daniela Rus

机构 * Massachusetts Institute of Technology(麻省理工学院) Toyota Research Institute(丰田研究机构)

专题命中 逻辑推理 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04023 2025-11-07 cs.SE cs.CR 50%

LLM-Driven Adaptive Source-Sink Identification and False Positive Mitigation for Static Analysis

Shiyin Lin

专题命中 逻辑推理 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01802 2025-11-04 cs.CV 50%

PROPEX-RAG: Enhanced GraphRAG using Prompt-Driven Prompt Execution

Tejas Sarnaik, Manan Shah, Ravi Hegde

机构 * Indian Institute of Technology, Gandhinagar, Gujarat, India(印度理工学院冈丁加尔分校,古吉拉特邦,印度)

专题命中 逻辑推理 :reasoning(abstract)

Comments Accepted in PReMI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14008 2025-10-22 cs.MA 50%

Stop Reducing Responsibility in LLM-Powered Multi-Agent Systems to Local Alignment

Jinwei Hu, Yi Dong, Shuang Ao, Zhuoyun Li, Boxuan Wang, Lokesh Singh, Guangliang Cheng, Sarvapali D. Ramchurn, Xiaowei Huang

专题命中 逻辑推理 :reasoning(abstract)

Comments Updated manuscript of our previous version (arXiv:2502.01714). Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20534 2025-10-17 cs.PL cs.MS cs.SC 50%

Efficient Symbolic Computation via Hash Consing

Bowen Zhu, Aayush Sabharwal, Songchen Tan, Yingbo Ma, Alan Edelman, Christopher Rackauckas

专题命中 逻辑推理 :reasoning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11005 2025-10-14 cs.CV 50%

Frequency Domain Unlocks New Perspectives for Abdominal Medical Image Segmentation

Kai Han, Siqi Ma, Chengxuan Qian, Jun Chen, Chongwen Lyu, Yuqing Song, Zhe Liu

机构 * School of Computer Science and Communication Engineering, Jiangsu University(江苏大学计算机科学与通信工程学院)

专题命中 逻辑推理 :planning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏