arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45335 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3046 篇

2507.18375 2026-04-28 cs.CC cs.LO 50%

Fagin's Theorem for Semiring Turing Machines

对于半环图灵机的法金定理

Guillermo Badia, Manfred Droste, Thomas Eiter, Rafael Kiesel, Carles Noguera, Erik Paul

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文改进了Eiter和Kiesel的SRTM模型,证明了在改进模型下,NP_∞(R)可通过允许谓词解释为半环注释关系的加权存在第二阶逻辑捕捉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17321 2026-04-28 cs.RO 50%

Neuro-Symbolic Control with Large Language Models for Language-Guided Spatial Tasks

基于大语言模型的神经符号控制用于语言引导的空间任务

Momina Liaqat Ali, Muhammad Abid, Muhammad Saqlain, Jose M. Merigo

机构 * Department of Computer Science, Middle Tennessee State University(中田纳西州立大学计算机科学系) Department of Mechanical and Aerospace Engineering, University of Tennessee(田纳西大学机械与航空航天工程系) School of Computer Science, Faculty of Engineering, and Information Technology, University of Technology Sydney(悉尼技术大学工程与信息技术学院计算机科学系) School of Computer Science, Faculty of Engineering and Information Technology, University of Technology Sydney(悉尼技术大学工程与信息技术学院计算机科学系)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出一种神经符号控制框架,结合轻量神经控制器和本地大语言模型,通过符号任务解释与低层运动执行分离,提升空间任务的成功率和效率,实验证明在连续控制中具有更高的稳定性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18590 2026-04-22 cs.HC cs.CY 50%

Critical Thinking in the Age of Artificial Intelligence: A Survey-Based Study with Machine Learning Insights

人工智能时代的关键思维:基于调查的综述与机器学习洞察

M Murshidul Bari, Akif Islam, Mohd Ruhul Ameen, Abu Saleh Musa Miah, Jungpil Shin

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文通过访谈和逻辑推理任务探讨人工智能使用行为与批判性思维表现的关系,发现用户对AI的依赖程度和耐心影响推理能力,表明AI影响因使用方式而异。

Comments 5 Figures, 2 Tables, Submitted to International Conference On Power, Electronics, Communications, Computing, and Intelligent Infrastructure 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17142 2026-04-21 cs.MA 50%

Logic-Based Verification of Task Allocation for LLM-Enabled Multi-Agent Manufacturing Systems

基于逻辑的任务分配验证在LLM赋能的多智能体制造系统中

Jonghan Lim, Mostafa Tavakkoli Anbarani, Rômulo Meira-Góes, Ilya Kovalenko

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出一种利用大语言模型灵活性并保持安全性的控制架构,通过时序逻辑和离散事件系统验证任务分配,通过多机器人装配案例证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16541 2026-04-21 cs.CV 50%

BOOKAGENT: Orchestrating Safety-Aware Visual Narratives via Multi-Agent Cognitive Calibration

BOOKAGENT:通过多智能体认知校准 orchestrate 安全意识的视觉叙述

Bo Gao, Chang Liu, Yuyang Miao, Siyuan Ma, Ser-Nam Lim

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Science and Technology of China(中国科学技术大学) Imperial College London(伦敦帝国理工学院) Nanyang Technological University(南洋理工大学) University of Central Florida(佛罗里达中央大学)

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出BOOKAGENT,一种安全意识的多智能体协作框架,用于高质量的视觉叙述生成,通过联合规划、脚本、插图和全局修复不一致,提升叙述连贯性和视觉一致性。

Comments 18 pages, Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15623 2026-04-20 cs.AR 50%

Overmind NSA: A Unified Neuro-Symbolic Computing Architecture with Approximate Nonlinear Activations and Preemptive Memory Bypass

Overmind NSA:一种具有近似非线性激活和抢先记忆绕过功能的统一神经符号计算架构

Weilun Wang, Zirui Wang, Wantong Li

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出Overmind架构,通过Padé近似、抢先记忆绕过和软件栈优化,解决神经符号计算中的计算瓶颈,实现高能效和吞吐量。

Comments Accepted to DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15163 2026-04-20 cs.DB 50%

DPC: Training-Free Text-to-SQL Candidate Selection via Dual-Paradigm Consistency

DPC:基于双范式一致性的无训练文本到SQL候选选择

Boyan Li, Ou Ocean Kun Hei, Yue Yu, Yuyu Luo

专题命中 逻辑推理 :self-correction(abstract)

AI总结 本文提出DPC方法,通过双范式一致性框架解决文本到SQL的生成与选择差距问题,利用SLICER和TESTER代理构建最小区分数据库,通过执行一致性验证提升候选选择准确性。

Comments ACL 2026 (Main Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14044 2026-04-16 cs.CV 50%

Decoding the Delta: Unifying Remote Sensing Change Detection and Understanding with Multimodal Large Language Models

解读Delta:利用多模态大语言模型统一遥感变化检测与理解

Xiaohe Li, Jiahao Li, Kaixin Zhang, Yuqiang Fang, Leilei Lin, Hong Wang, Haohua Wu, Zide Fan

机构 * Aerospace Information Research Institute, CAS(航天信息研究所,中国科学院) Space Engineering University(航天工程大学) Capital Normal University(首都师范大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出Delta-LLaVA框架,通过多时间尺度对比推理和空间定位,解决遥感变化理解中的时间盲问题,实现像素级分割与视觉问答的统一。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06846 2026-04-15 cs.CR 50%

CKG-LLM: LLM-Assisted Detection of Smart Contract Access Control Vulnerabilities Based on Knowledge Graphs

CKG-LLM:基于知识图谱的智能合约访问控制漏洞检测框架

Xiaoqi Li, Hailu Kuang, Wenkai Li, Zongwei Li, Shipeng Ye

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出CKG-LLM框架,利用大语言模型能力将自然语言漏洞模式转化为知识图谱查询,提升智能合约访问控制漏洞检测性能。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07592 2026-04-10 cs.RO 50%

Spatio-Temporal Grounding of Large Language Models from Perception Streams

从感知流中对大语言模型进行时空 grounding

Jacob Anderson, Bardh Hoxha, Georgios Fainekos, Hideki Okamoto, Danil Prokhorov

机构 * Toyota Motor North America Research & Development(丰田北美研发中心)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出FESTS框架,通过将自然语言查询转化为SpRE,为大语言模型注入可验证的时空监督,提升时空推理能力,使30亿参数模型在27k数据上实现87.5%的帧级F1分数,接近GPT-4.1性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06722 2026-04-09 cs.CY cs.RO 50%

Infrastructure First: Enabling Embodied AI for Science in the Global South

基础设施优先:为全球南方科学赋能具身AI

Shaoshan Liu, Jie Tang, Marwa S. Hassan, Mohamed H. Sharkawy, Moustafa M. G. Fouda, Tiewei Shang, Zixin Wang

机构 * Shenzhen Institute of Artificial Intelligence and Robotics for Society (AIRS)(深圳市人工智能与机器人研究院(AIRS)) South China University of Technology(华南理工大学) National Research Centre (NRC)(国家研究中心(NRC)) British University in Egypt (BUE)(埃及英国大学(BUE)) National Institute of Clean-and-Low-Carbon Energy(国家清洁低碳能源研究所)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文探讨了通过具身AI赋能科学的基础设施优先方法,强调在人力、电力和网络受限的全球南方地区,通过可靠边缘计算、能效硬件和开放标准等基础设施提升科学能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06506 2026-04-09 cs.CR cs.SE 50%

Guiding Symbolic Execution with Static Analysis and LLMs for Vulnerability Discovery

通过静态分析和LLMs引导符号执行以发现漏洞

Md Shafiuzzaman, Achintya Desai, Wenbo Guo, Tevfik Bultan

专题命中 逻辑推理 :reasoning(abstract)

AI总结 SAILOR结合静态分析与LLM合成自动构建符号执行Harness,通过三个阶段发现内存安全漏洞,实验表明其在大规模代码库中显著提升漏洞检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04081 2026-04-07 physics.comp-ph physics.ed-ph physics.soc-ph quant-ph 50%

Co-Authoring with AI: How I Wrote a Physics Paper About AI, Using AI

与AI共同撰写:我如何用AI写了一篇关于AI的物理学论文

Yi Zhou

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文探讨AI在科学写作中的作用,强调人类在保持物理逻辑和学术规范中的关键责任,提出必须发表完整的AI交互记录以确保科学记录的完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17586 2026-04-06 cs.DB 50%

DeepEye-SQL: A Software-Engineering-Inspired Text-to-SQL Framework

DeepEye-SQL: 一种受软件工程启发的文本到SQL框架

Boyan Li, Chong Chen, Zhujun Xue, Yinan Mei, Yuyu Luo

专题命中 逻辑推理 :reasoning(abstract)

AI总结 DeepEye-SQL通过结构化协作提升文本到SQL的可靠性,采用软件开发生命周期指导,实现73.5%的BIRD-Dev准确率和89.8%的Spider-Test表现,优于现有方法。

Comments SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00628 2026-04-02 cs.RO cs.HC 50%

StretchBot: A Neuro-Symbolic Framework for Adaptive Guidance with Assistive Robots

StretchBot:一种用于辅助机器人自适应指导的神经符号框架

Luca Vogelgesang, Ahmed Mehdi Soltani, Mohammadhossein Khojasteh, Xinrui Zu, Stefano De Giorgis, Madalina Croitoru, Filip Ilievski

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) University of Montpellier(蒙彼利埃大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出StretchBot,结合多模态感知与知识图谱引导的大语言模型推理,实现短时间伸展指导中的情境感知调整,同时保持结构化流程。实验显示自适应指导在适应性和相关性上更优,而脚本指导在流畅性和可预测性上仍具竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28952 2026-04-01 cs.RO 50%

World2Rules: A Neuro-Symbolic Framework for Learning World-Governing Safety Rules for Aviation

World2Rules: 一种用于航空领域学习世界治理安全规则的神经符号框架

Haichuan Wang, Jay Patrikar, Sebastian Scherer

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 World2Rules通过结合神经网络和符号方法,从航空多模态数据中学习安全规则,提升规则的准确性和可解释性,实验显示其在F1得分上优于纯神经和单步神经符号基线。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28068 2026-04-01 cs.CV 50%

AIBench: Evaluating Visual-Logical Consistency in Academic Illustration Generation

AIBench:评估学术示意图生成中的视觉-逻辑一致性

Zhaohe Liao, Kaixun Jiang, Zhihang Liu, Yujie Wei, Junqiu Yu, Quanhao Li, Hong-Tao Yu, Pandeng Li, Yuzheng Wang, Zhen Xing, Shiwei Zhang, Chen-Wei Xie, Yun Zheng, Xihui Liu

机构 * Tongyi Lab, Alibaba Group(阿里巴巴集团通义实验室) SJTU(上海交通大学) FDU(复旦大学) USTC(中国科学技术大学) SEU(东南大学) HKU(香港大学)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出AIBench,首个通过VQA评估学术示意图逻辑正确性及VLM评估美观性的基准,通过四层问题验证生成示意图与论文的一致性,发现模型在该任务上的性能差异显著,且逻辑与美观难以同时优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07240 2026-03-31 eess.SY cs.MA cs.SY 50%

Continuous-Time Control Synthesis for Multiple Quadrotors under Signal Temporal Logic Specifications

多四旋翼在信号时间逻辑规范下的连续时间控制合成

Yating Yuan, Yu Liu

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出双阶段框架,基于几何控制进行Lyapunov分析并设计多维增益,结合混合整数凸优化生成满足多智能体STL任务的轨迹,提升系统鲁棒性和暂态性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02028 2026-03-31 cs.CV cs.CR 50%

See No Evil: Adversarial Attacks Against Linguistic-Visual Association in Referring Multi-Object Tracking Systems

见无所见:对抗性攻击针对参考多目标跟踪系统中的语言-视觉关联

Halima Bouzidi, Haoyu Liu, Mohammad Abdullah Al Faruque

机构 * University of California, Irvine(加利福尼亚大学尔湾分校)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文研究了参考多目标跟踪系统在设计逻辑上的安全问题,揭示了语言-视觉关联和目标匹配组件的对抗性漏洞,并提出VEIL框架以破坏其统一的参考匹配机制。

Comments Accepted to the NeurIPS 2025 Workshop on Reliable ML from Unreliable Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22708 2026-03-25 cs.DB 50%

Why Database Manuals Are Not Enough: Efficient and Reliable Configuration Tuning for DBMSs via Code-Driven LLM Agents

为何数据库手册不够:通过代码驱动的LLM代理实现DBMS的高效可靠配置调优

Xinyi Zhang, Tiantian Chen, Zhentao Han, Zhaoyan Hong, Wei Lu, Sheng Wang, Mo Sha, Anni Wang, Shuang Liu, Yakun Zhang, Feifei Li, Xiaoyong Du

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出SysInsight系统,通过代码分析和LLM推理从DBMS源代码中提取细粒度调优知识,加速稳定调优过程,实现7.11倍更快收敛和19.9%性能提升。

Comments Accepted by VLDB 2026

Journal ref VLDB 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21802 2026-03-24 cs.LO cs.MA 50%

Modal Logic for Distributed Trust

分布式信任的模态逻辑

Niels Voorneveld, Peeter Laud

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出一种用于多智能体系统信任推理的方法,通过定义描述通信协议的语言及信任假设,利用模态逻辑建模网络中智能体的信念与通信,探讨信息共享与跨网络信任泛化机制。

Comments 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19909 2026-03-23 cs.IR 50%

DALI: LLM-Agent Enhanced Dual-Stream Adaptive Leadership Identification for Group Recommendations

DALI:LLM-Agent增强的双流自适应领导力识别用于群体推荐

Boxun Song, Min Gao, Jiawei Cheng

专题命中 逻辑推理 :reasoning(abstract)

AI总结 DALI通过结合大语言模型的符号推理能力与神经网络表示学习,解决群体推荐中区分领导主导与协作群体的问题,提升推荐准确性。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19239 2026-03-23 cs.PL cs.SE 50%

Defusing Logic Bombs in Symbolic Execution with LLM-Generated Ghost Code

用LLM生成的鬼代码解构符号执行中的逻辑炸弹

Dimitrios Stamatios Bouras, Sergey Mechtaev

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出Gordian框架,通过LLM生成轻量级鬼代码辅助SMT求解器处理对抗性代码,提升覆盖率和效率,减少LLM使用量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15087 2026-03-17 cs.SE 50%

Beyond Monolithic Models: Symbolic Seams for Composable Neuro-Symbolic Architectures

超越单体模型:符号缝合用于可组合的神经符号架构

Nicolas Schuler, Vincenzo Scotti, Raffaela Mirandola

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出符号缝合概念,旨在通过可组合的神经符号架构提升AI系统的可扩展性和透明性,结合数据驱动的适应性与显式约束的可验证性。

Comments Submitted to New and Emerging Ideas (NEMI) track at ICSA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05065 2026-03-17 cs.CR 50%

Personalizing Agent Privacy Decisions via Logical Entailment

通过逻辑蕴含个性化代理隐私决策

James Flemings, Ren Yi, Octavian Suciu, Kassem Fawaz, Murali Annavaram, Marco Gruteser

专题命中 逻辑推理 :reasoning(abstract)

AI总结 本文提出ARIEL框架,结合LLM与规则逻辑,实现结构化个性化隐私决策,实验显示其在适当判断的F1误差率上降低40.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13723 2026-03-17 cs.SE 50%

Do AI Agents Really Improve Code Readability?

AI代理真的能提高代码可读性吗?

Kyogo Horikawa, Kosei Horikawa, Yutaro Kashiwa, Hidetake Uwano, Hajimu Iida

专题命中 逻辑推理 :planning(abstract)

AI总结 研究探讨AI代理重构对代码可读性的影响,通过分析403个提交发现,AI主要改进逻辑复杂度和文档,但导致传统质量指标下降。

Comments 5 pages

Journal ref 23rd International Conference on Mining Software Repositories (MSR '26) , 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13333 2026-03-17 cs.RO 50%

STL-SVPIO: Signal Temporal Logic guided Stein Variational Path Integral Optimization

STL-SVPIO:信号时序逻辑引导的Stein变分路径积分优化

Hongrui Zheng, Zirui Zang, Ahmad Amine, Cristian Ioan Vasile, Rahul Mangharam

机构 * Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系) Mechanical Engineering and Mechanics Department, Lehigh University(莱特大学机械工程与力学系)

专题命中 逻辑推理 :planning(abstract)

AI总结 本文提出STL-SVPIO方法,通过将信号时序逻辑转化为可微的奖励塑造机制,解决复杂STL约束下的长周期连续控制轨迹合成问题,提升鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11622 2026-03-13 cs.DB 50%

Sema: A High-performance System for LLM-based Semantic Query Processing

Sema: 一种高性能的基于大语言模型的语义查询处理系统

Kangkang Qi, Dongyang Xie, Wenbo Li, Hao Zhang, Yuanyuan Zhu, Jeffrey Xu Yu, Kangfei Zhao

专题命中 逻辑推理 :reasoning(abstract)

AI总结 Sema 是一种基于 DuckDB 构建的高性能语义查询引擎,通过 SemaSQL 实现自然语言表达与 SQL 的无缝集成,提升语义查询的性能和结果质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11605 2026-03-13 cs.CV 50%

LaMoGen: Language to Motion Generation Through LLM-Guided Symbolic Inference

LaMoGen:通过LLM引导的符号推理实现语言到动作生成

Junkun Jiang, Ho Yin Au, Jingyu Xiang, Jie Chen

机构 * Department of Computer Science, Hong Kong Baptist University, HKSAR(香港 Baptist 大学计算机科学系)

专题命中 逻辑推理 :reasoning(abstract)

AI总结 LaMoGen通过LLM引导的符号推理实现语言到动作的生成,利用LabanLite动作表示提升动作的可解释性和可控性。

Comments Accepted by CVPR 2026. Supplementary material included. Project page: https://jjkislele.github.io/LaMoGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11489 2026-03-13 cs.PL cs.AR 50%

AutoVeriFix+: High-Correctness RTL Generation via Trace-Aware Causal Fix and Semantic Redundancy Pruning

AutoVeriFix+: 通过轨迹感知因果修复和语义冗余剪枝实现高正确性的RTL生成

Yan Tan, Xiangchen Meng, Zijun Jiang, Yangdi Lyu

专题命中 逻辑推理 :reasoning(abstract)

AI总结 AutoVeriFix+通过轨迹感知因果修复和语义冗余剪枝,提升Verilog代码生成的功能正确性与设计效率。

Comments arXiv admin note: text overlap with arXiv:2509.08416

详情

展开后加载摘要…

URL PDF HTML 收藏