arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45259 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3043 篇

2607.07386 2026-07-09 cs.LG 新提交 57%

Sparse Delta Memory: Scaling the State of Linear RNNs through Sparsity

稀疏增量记忆:通过稀疏性扩展线性循环神经网络的状态

Loïc Cabannes, Pierre-Emmanuel Mazaré, Gergely Szilvasy, Matthijs Douze, Maria Lomeli, Ilze Amanda Auzina, Justin Carpentier, Gabriel Synnaeve, Hervé Jégou

机构 * Meta FAIR Inria Paris(巴黎信息与自动化研究所) ENS-PSL University(巴黎文理研究大学) University of Tübingen(图宾根大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 研究针对线性注意力模型长上下文召回不足的问题,提出稀疏增量记忆(SDM)架构,通过稀疏寻址扩展门控线性循环神经网络隐藏状态,在等FLOP和参数数量下提升性能,还能改进常识与推理任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30170 2026-07-09 cs.MM cs.CV cs.LG 版本更新 57%

Unveiling the Visual Counting Bottleneck in Vision-Language Models

揭示视觉语言模型中的视觉计数瓶颈

Xingzhou Pang, Yifan Hou, Junling Wang, Mrinmaya Sachan

机构 * Department of Computer Science, ETH Zürich(苏黎世联邦理工学院计算机科学系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 通过分解视觉计数为三个认知阶段,发现视觉语言模型在符号映射阶段失败,提出断裂数量假说:模型学习到分离的模态特定统计流形,无法实现跨模态对齐。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00086 2026-07-09 cs.CL 版本更新 57%

RIMRULE: Improving Tool-Using Language Agents via MDL-Guided Rule Learning

RIMRULE:通过MDL引导的规则学习改进使用工具的语言智能体

Xiang Gao, Yuguang Yao, Qi Zhang, Kaiwen Dong, Avinash Baidya, Ruocheng Guo, Hilaf Hasson, Kamalika Das

机构 * Intuit AI Research(Intuit AI研究)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 研究针对大型语言模型在特定领域使用工具的难题,提出RIMRULE神经符号方法,通过从失败轨迹提炼规则并用MDL目标巩固,以动态注入规则提升性能,实验证明该方法能提高工具使用准确性,且规则具有跨架构可移植性。

Comments Published as a long paper in the main conference of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05168 2026-07-07 cs.AI cs.LO 新提交 57%

The Changing Role of Symbolic Methods in Artificial Intelligence

符号方法在人工智能中不断演变的角色

Jun Sun

机构 * Singapore Management University(新加坡管理大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出压缩原理与建模-推理权衡,指出显式符号推理是简化现实模型的计算产物,未来符号方法将成为高能力AI与人类间的交互接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05123 2026-07-07 cs.AI cs.CV 新提交 57%

ASSEMCAD: Production-Ready CAD Assembly Generation from Natural Language

ASSEMCAD:从自然语言生成可用于生产的CAD装配体

Yurui Dong, Shu Zou, Siqi Li, Nianchen Deng, Hongbin Zhou, Xuemeng Yang, Pinlong Cai, Licheng Wen, Xinyu Cai, Botian Shi

机构 * Computer-aided design (CAD) briere2012comparing models(计算机辅助设计(CAD)模型)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 研究如何从自然语言生成可用于生产的CAD装配体,提出公理基础框架AssemCAD,通过构建公理装配规范、引入特定CAD装配库等方法,提升装配体生成质量,扩展文本到CAD设计。

Comments 26 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03847 2026-07-07 cs.LG 新提交 57%

NeSy-CSA: A Neuro-Symbolic Framework for Open-Ended Critical Scenario Attribution

NeSy-CSA:一种用于开放式关键场景归因的神经符号框架

Qitong Chu, Xunjie He, Chen Deng, Huaxin Pei, Yufeng Yue

机构 * School of Automation, Beijing Institute of Technology(北京理工大学自动化学院) Department of Automation, Tsinghua University(清华大学自动化系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 研究如何理解场景测试中关键场景的成因,提出神经符号框架NeSy-CSA,通过选择相关因素缩小归因空间,经证据图使推理可追溯,结合符号与神经推理,提升关键场景归因有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03591 2026-07-07 cs.CV cs.AI cs.CY 新提交 57%

Responsibility Distribution Estimation in Ego-View Accident Videos with Multimodal Large Language Models

基于多模态大语言模型的第一视角事故视频中的责任分配估计

Ryosei Tamura, Andrew Shin

机构 * Keio University(庆应大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 研究第一视角事故视频中责任分配估计新任务,构建大语言模型辅助的责任标注管道并在多输入设置下微调模型,实验证明多模态大语言模型能有效执行该任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02907 2026-07-07 cs.CV cs.CL 新提交 57%

ProLaViT: Learning Progressive Latent Visual Thoughts in Structured Latent Space

ProLaViT:在结构化潜在空间中学习渐进式潜在视觉思维

Peiming Li, Yifan Wang, Xiaotian Zhang, Zhiyuan Hu, Shiyu Li, Zheng Wei, Yang Tang

机构 * Basic Algorithm Center, PCG, Tencent(腾讯PCG基础算法中心) Zhejiang University(浙江大学) Peking University(北京大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 针对多模态大语言模型在复杂视觉推理任务中的不足,ProLaViT框架利用内生自蒸馏机制等,设计两种推理范式及损失函数,使其能在潜在空间进行结构化视觉推导,实验证明效果优于基线。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01306 2026-07-03 cs.AI 新提交 57%

PACE: A Neuro-Symbolic Framework for Plausible and Actionable Counterfactual Explanations

PACE: 一种用于合理且可操作的反事实解释的神经符号框架

Pavel Iakovets, Liyanapathiranage Sudeepika Wajirakumari Samarathunga, Martin Thomas Horsch, Fadi Al Machot

机构 * University of Klagenfurt(克拉根福大学) Norwegian University of Life Sciences(挪威生命科学大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出PACE框架,结合神经网络预测与符号推理,生成符合领域约束的可操作反事实解释,在Adult Income数据集上验证了可行性与可解释性的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17965 2026-07-03 cs.SE cs.AI 版本更新 57%

BLAgent: Agentic RAG for File-Level Bug Localization

BLAgent: 一种面向文件级Bug定位的代理RAG

Md Afif Al Mamun, Gias Uddin

机构 * University of Calgary(卡尔加里大学) York University(约克大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出BLAgent,一种新型代理RAG框架,用于文件级Bug定位,通过结合代码结构感知的仓库编码、双视角查询转换和两阶段代理重排序,提高了Bug定位的准确性和效率。

Comments Accepted for publication in ACM Transactions on Software Engineering and Methodology (TOSEM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01188 2026-07-02 cs.AI cond-mat.mtrl-sci 新提交 57%

Optimal Resource Utilization for Autonomous Laboratory Orchestrators

自主实验室协调器的最优资源利用

Austin McDannald, Julia Tisaranni, Howie Joress

机构 * National Institute of Standards and Technology(美国国家标准与技术研究院)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 针对自主实验室中多仪器硬件约束下的资源利用问题,提出两步法:先用约束规划找到最小化总时间的最优调度,再通过状态依赖系统鲁棒执行调度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01006 2026-07-02 cs.CL 新提交 57%

Understanding Large Language Models

理解大型语言模型

Yannik Keller, Thomas Eisenmann

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文综述大型语言模型(LLM)的机制、涌现能力及与人类认知的关系,通过分析注意力机制、符号推理、心智理论等证据,探讨LLM是否真正理解语言,并反对过度简化的人机认知差异观点。

Comments 25 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09204 2026-07-01 cs.RO cs.LG 版本更新 57%

Flow-Opt: Scalable Centralized Multi-Robot Trajectory Optimization with Flow Matching and Differentiable Optimization

Flow-Opt: 用于多机器人轨迹优化的可扩展集中式方法,结合流匹配与可微优化

Simon Idoko, Prajyot Jadhav, Arun Kumar Singh

机构 * University of Tartu(塔尔图大学)

专题命中 逻辑推理 :planning(abstract);分类 cs.LG

AI总结 本文提出Flow-Opt,通过生成模型与可微优化提升集中式多机器人轨迹优化的计算效率,实现快速生成数十机器人在复杂环境中的平滑轨迹,并支持批量处理与多样化路径生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24575 2026-07-01 cs.RO cs.LG cs.MA 版本更新 57%

Prompting Robot Teams with Natural Language

用自然语言提示机器人团队

Eduardo Sebastián, Nicolas Pfitzer, Ajay Shankar, Amanda Prorok

机构 * Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系) Department of Mechanical and Process Engineering, ETH Zurich(苏黎世联邦理工学院机械与过程工程系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.LG

AI总结 提出利用语言模型将高层任务分解为子任务,并蒸馏为循环神经网络(RNN)以支持多机器人团队的去中心化实时执行,通过图神经网络控制策略实现协作。

Comments This paper has been accepted for publication at IEEE Robotics and Automation Letters. Please, when citing the paper, refer to the official version

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29799 2026-06-30 cs.AI 57%

The CRISTAL Method: Neurosymbolic analysis from AI-synthesized world models

CRISTAL方法:来自AI合成世界模型的神经符号分析

Rafael Kaufmann, Felix Neubürger, Michael Walters, Thomas Kopinski, Dimitrije Marković

机构 * GAIA Lab(GAIA实验室) South Westphalia University of Applied Sciences(西南弗里西亚应用科学大学) Technical University Dresden(德累斯顿技术大学) Primordia Co.(Primordia公司)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出CRISTAL神经符号框架,通过贝叶斯推理、主动学习和持续学习自动化复杂分析,在合成股票分类任务中仅用5个样本和5秒达到贝叶斯最优精度,远超LLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28011 2026-06-29 eess.SY cs.LG cs.SY 新提交 57%

From Detection to Action: Using LLM Agents for Fault-Tolerant Control

从检测到行动:使用LLM智能体进行容错控制

Javal Vyas, Milapji Singh Gill, Artan Markaj, Felix Gehlhoff, Mehmet Mercangöz

机构 * Imperial College London(帝国理工学院伦敦校区) Helmut Schmidt University(海德堡-施密特大学)

专题命中 逻辑推理 :planning(abstract);分类 cs.LG

AI总结 提出基于大语言模型智能体的主动容错控制框架,通过多智能体协作、数字孪生和知识图谱增强检索,生成并验证最小风险恢复路径,在离散和连续过程控制中实现从故障检测到有效纠正行动的闭环。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03269 2026-06-29 cs.AI 版本更新 57%

Distilling Answer-Set Programming Rules from LLMs for Neurosymbolic Visual Question Answering

从LLM中蒸馏答案集编程规则用于神经符号视觉问答

Thomas Eiter, Nelson Higuera Ruiz, Johannes Oetsch

机构 * Vienna University of Technology ( TU Wien )(维也纳技术大学) Jönköping University(约克灵厄普大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出从大语言模型中蒸馏答案集编程规则的方法,以可解释的方式扩展视觉问答系统的推理能力,仅需少量示例即可生成正确规则。

Comments Under consideration in Theory and Practice of Logic Programming (TPLP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18558 2026-06-29 cs.CV cs.AI 版本更新 57%

HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering

HiMu: 面向长视频问答的分层多模态帧选择

Dan Ben-Ami, Gabriele Serussi, Kobi Cohen, Chaim Baskin

机构 * INSIGHT Lab, Ben-Gurion University of the Negev, Israel(本-古里安内盖夫大学INSIGHT实验室,以色列) Ben-Gurion University of the Negev, Israel(本-古里安内盖夫大学,以色列)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出HiMu框架,通过文本LLM将查询分解为层次逻辑树,由视觉和音频专家处理原子谓词,经模糊逻辑算子组合生成连续帧满意度曲线,在16帧预算下达到帧选择方法的最优精度,并作为即插即用模块提升多种MLLM性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26585 2026-06-26 cs.AI astro-ph.IM 新提交 57%

A Multi-Level Validation and Traceability Framework for AI-Generated Telescope Scheduling Decisions

AI生成的望远镜调度决策的多级验证与可追溯性框架

Hengchu Xiao, Chuanjun Wang

机构 * Yunnan Observatories, Chinese Academy of Sciences(云南天文台,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of the Structure and Evolution of Celestial Objects, Chinese Academy of Sciences(中国科学院天文结构与演化重点实验室) Yunnan Key Laboratory of Solar Physics and Space Science(云南太阳物理与空间科学重点实验室) Center for Astronomical Mega-Science, Chinese Academy of Sciences(中国科学院天文大科学中心)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出多级验证与可追溯推理框架,通过数据引用验证、逻辑一致性检查和约束验证,提高AI调度决策的可执行性和可靠性,减少瞬态机会损失。

Comments 25 pages, 8 figures, Published in Universe

Journal ref Universe, Volume 12, Issue 6, 172 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07407 2026-06-26 cs.CL 版本更新 57%

Training Language Models to Use Prolog as a Tool

训练语言模型以使用Prolog作为工具

Niklas Mellgren, Peter Schneider-Kamp, Lukas Galke Poech

机构 * University of Southern Denmark(南丹麦大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文探讨通过强化学习训练语言模型使用Prolog进行符号推理,发现正确性与可审计性之间存在权衡,影响模型性能与可解释性。

Comments ACL 2026 Findings (change from last version: corrected year in this comment)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21565 2026-06-23 cs.AI 新提交 57%

Composing Verifiable Conceptual Models via Building Blocks: Towards Design-Time Verification of Agentic AI Workflows

通过构建块组合可验证的概念模型:面向智能体AI工作流的设计时验证

Noe Y. Flandre, Alexander C. Nwala, Philippe J. Giabbanelli

机构 * Team EVERGREEN Inria Centre Inria d’Université Côte d’Azur(法国国家信息与自动化研究所蔚蓝海岸大学中心EVERGREEN团队) Department of Data Science William & Mary(威廉与玛丽学院数据科学系) Office of Enterprise Research and Innovation Old Dominion University(欧道明大学企业研究与创新办公室)

专题命中 逻辑推理 :verifier(abstract);分类 cs.AI

AI总结 提出一种设计时验证方法,通过12条结构规则检查智能体工作流中可重用构建块的兼容性,实现设计缺陷检测。

Comments To appear at the 2026 Winter Simulation Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21445 2026-06-23 cs.AI 新提交 57%

AutoRAS: Learning Robust Agentic Systems with Primitive Representations

AutoRAS: 学习具有原始表示的鲁棒智能系统

Yang Yue, Xuancheng Zhu, Yuyang Ma, Guoshun Nan, Zihan Dou, Jingru Shan, Congyu Guo, Ji Zhang, Hua Wang, Jingfeng Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Guangxi Transportation Science and Technology Group Co., Ltd.(广西交通科技集团有限公司) Fudan University(复旦大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出AutoRAS框架,通过生成符号原始序列并利用执行安全信号和流式序列级目标优化,自动设计鲁棒智能系统,在正常和对抗设置下均表现最佳。

Comments Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14935 2026-06-23 cs.AI 新提交 57%

PrologMCP: A Standardized Prolog Tool Interface for LLM Agents

PrologMCP:面向LLM代理的标准化Prolog工具接口

Agnieszka Mensfelt, Adarsh Prabhakaran, Adrian Haret, Vince Trencsenyi, Kostas Stathis

机构 * Royal Holloway, University of London(伦敦大学皇家霍洛威学院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出PrologMCP,一个通过模型上下文协议将Prolog暴露为状态化工具的任务无关开源服务器,使LLM代理能够通过翻译-运行-检查-修复循环稳健地委托演绎推理,在PARARULE-Plus上达到或超越推理型LLM。

Comments Accepted at Joint Workshop on Statistics and Knowledge Integration for Logic, Learning, Ethical Decisions, and LLMs, 18 July 2026, Lisbon v2: Added references to other Prolog MCP servers; fixed typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20093 2026-06-19 cs.CL 新提交 57%

Self-Preference Is Weak or Absent in Verifiable Instruction-Following Revision: A Four-Model Test Under Genuine Authorship

自我偏好在可验证的指令遵循修订中弱或不存在:基于真正作者身份的四模型测试

William Guey, Pierrick Bougault

机构 * Department of Industrial Engineering, Tsinghua University(清华大学工业工程系)

专题命中 逻辑推理 :verifier(abstract);分类 cs.CL

AI总结 通过IFEval验证器测试四类中端模型在指令遵循修订中的自我偏好,发现作者拒绝已验证正确编辑的比例与新鲜模型无显著差异,表明自我偏好弱或不存在。

Comments 7 pages, 3 tables. Code and data: https://github.com/williamguey/self-preference-revision

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18272 2026-06-19 cs.NI cs.AI cs.SY eess.SY 新提交 57%

Mitigating Anchoring Bias in LLM-Based Agents for Energy-Efficient 6G Autonomous Networks

缓解基于LLM的智能体在节能6G自主网络中的锚定偏差

Hatim Chergui, Claudia Carballo González, Farhad Rezazadeh, Merouane Debbah

机构 * i2CAT Foundation(i2CAT基金会) Universitat Politècnica de Catalunya(政治技术大学) Research Institute for Digital Future(数字未来研究院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出一种基于截断三参数威布尔分布的随机锚定策略,缓解LLM智能体在6G网络切片中的锚定偏差,结合CVaR数字孪生保障SLA尾延迟,实现高达25%的节能。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05107 2026-06-18 cs.AI 版本更新 57%

Structured Cognitive Loop for Behavioral Intelligence in Large Language Model Agents (Extended Revision: From Behavioral Architecture to Epistemic Accountability)

大型语言模型代理中行为智能的结构化认知循环(扩展修订:从行为架构到认知问责)

Myung Ho Kim

机构 * JEI University(JEI大学)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 提出结构化认知循环(SCL)架构,通过分离认知、记忆、控制和行动模块,实现LLM代理的可问责行为,在360个任务中成功率86.3%,优于基线方法。

Comments This revised version extends the original SCL framework from a behavioral architecture for reliable LLM agents into a broader architecture of epistemic accountability, integrating context-aware Human-in-the-Loop control, Pool-Gated Retrieval, and the Horizon-Warrant-Commitment structure

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17459 2026-06-17 cs.AI 新提交 57%

Can LLMs Be CEOs? Benchmarking Strategic Resource Reallocation with Multi-Role Agent Simulation

LLM 能当 CEO 吗?基于多角色智能体模拟的战略资源重新配置基准测试

Yuyang Dai, Xueqing Peng, Lingfei Qian, Zhuohan Xie

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) Yale University(耶鲁大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出 CEO-Bench,一个多智能体基准,评估 LLM 在约束丰富的组织环境中进行多轮战略资源重新配置的能力,发现模型在结构有效性上表现良好,但在战略校准上存在系统性失败模式。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15932 2026-06-17 cs.CL 新提交 57%

Beyond NL2Code: A Structured Survey of Multimodal Code Intelligence

超越NL2Code:多模态代码智能的结构化综述

Xuanle Zhao, Qiushi Sun, Jingyu Xiao, Xuexin Liu, Haoyue Yang, Qiaosheng Chen, Xianzhen Luo, Jing Huang, Yufeng Zhong, Lei Chen, Shuai Fu, Zhenlin Wei, Jinhe Bi, Lei Jiang, Haibo Qiu, Siqi Yang, Peng Shi, Jian Hu, Zhixiong Zeng

机构 * Meituan(美团) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Nanjing University(南京大学) Harbin Institute of Technology(哈尔滨工业大学) Australian Institute for Machine Learning, Adelaide University(阿德莱德大学澳大利亚机器学习研究所) Ludwig Maximilian University of Munich(慕尼黑大学) University of Science and Technology of China(中国科学技术大学) Queen Mary University of London(伦敦玛丽女王大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL

AI总结 本文系统综述多模态代码智能,将任务按代码角色分类,覆盖GUI、科学可视化、结构化图形及前沿任务,并提出四个基于验证的未来方向。

Comments Work completed in January 2026. Updating now

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12912 2026-06-17 cs.AI 57%

Human Emotion Verification by Action Languages via Answer Set Programming

通过答案集编程进行人类情感验证的动作语言

Andreas Brännström, Juan Carlos Nieves

机构 * Umeå University\ of Computing Science

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出动作语言C-MT,基于答案集编程和过渡系统,用于表示人类心理状态对可观察动作序列的演变。通过引入因果规则,该语言能建模心理状态的有效转换原则,从而实现对人类心理动态的受控推理。

Comments Under consideration in Theory and Practice of Logic Programming (TPLP)

Journal ref Theory and Practice of Logic Programming 25 (2025) 1047-1104

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02721 2026-06-17 cs.SE cs.AI cs.PL 版本更新 57%

Blueprint First, Model Second: A Framework for Deterministic LLM Workflow

蓝图优先,模型其次:确定性LLM工作流框架

Libin Qiu, Yuhang Ye, Zhirong Gao, Xide Zou, Junfu Chen, Ziming Gui, Weizhi Huang, Xiaobo Xue, Wenkai Qiu, Kun Zhao

机构 * Alibaba(阿里巴巴)

专题命中 逻辑推理 :planning(abstract);分类 cs.AI

AI总结 提出“蓝图优先,模型其次”框架,通过将工作流逻辑解耦为源代码蓝图并由确定性引擎执行,LLM仅处理子任务,在TravelPlanner上最终通过率提升97.6%,约束违反减少96.0%。

Comments 12 pages, 7 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏