arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-01-12 至 2026-01-12 共收录 12 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 12 篇

2601.04992 2026-01-12 cs.CL 85%

Learning from Mistakes: Negative Reasoning Samples Enhance Out-of-Domain Generalization

从错误中学习:负推理样本增强领域外泛化

Xueyun Tian, Minghua Ma, Bingbing Xu, Nuoyan Lyu, Wei Li, Heng Dong, Zheng Chu, Yuanzhuo Wang, Huawei Shen

机构 * CAS Key Laboratory of AI Safety, Institute of Computing Technology, CAS, Beijing, China(中国科学院人工智能安全重点实验室,计算技术研究所,中国科学院,北京,中国) Harbin Institute of Technology, Harbin, China(哈尔滨工业大学,哈尔滨,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) Tsinghua University, Beijing, China(清华大学,北京,中国)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 通过引入负例推理样本,GLOW方法有效提升了大语言模型在领域外任务中的泛化能力,通过调节损失下降和提升策略熵来减少过拟合并促进探索。

Comments Code and data are available at https://github.com/Eureka-Maggie/GLOW

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05560 2026-01-12 cs.CL cs.AI 84%

ReasonAny: Incorporating Reasoning Capability to Any Model via Simple and Effective Model Merging

ReasonAny: 通过简单有效的模型融合将推理能力融入任意模型

Junyao Yang, Chen Qian, Dongrui Liu, Wen Shen, Yong Liu, Jing Shao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) National University of Singapore(新加坡国立大学) Renmin University of China(中国人民大学) Tongji University(同济大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 ReasonAny通过对比梯度识别解决推理与领域性能崩溃问题,有效融合推理能力与领域专长,提升多领域模型性能。

Comments 22 pages, 6 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02163 2026-01-12 cs.AI cs.CL 81%

EverMemOS: A Self-Organizing Memory Operating System for Structured Long-Horizon Reasoning

EverMemOS:一种用于结构化长时程推理的自组织记忆操作系统

Chuanrui Hu, Xingze Gao, Zuyi Zhou, Dannong Xu, Yi Bai, Xintong Li, Hui Zhang, Tong Li, Chong Zhang, Lidong Bing, Yafeng Deng

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 EverMemOS通过自组织记忆系统提升长时程推理能力,实现事件轨迹捕捉、语义整合与重构性回忆,有效增强记忆增强推理任务的性能。

Comments 16 pages, 7 figures, 12 tables. Code available at https://github.com/EverMind-AI/EverMemOS

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08107 2026-01-12 cs.CL cs.DB cs.IR 74%

GRASP: Generic Reasoning And SPARQL Generation across Knowledge Graphs

GRASP:跨知识图谱的通用推理与SPARQL生成

Sebastian Walter, Hannah Bast

机构 * University of Freiburg(弗赖堡大学)

专题命中 其他推理 :reasoning(title);分类 cs.CL

AI总结 GRASP通过大型语言模型实现跨知识图谱的通用推理与SPARQL生成,无需微调,在多个基准中达到先进水平。

Comments Accepted for publication at ISWC 2025. This version of the contribution has been accepted for publication, after peer review but is not the Version of Record. The Version of Record is available online at: https://doi.org/10.1007/978-3-032-09527-5_15

Journal ref The Semantic Web - ISWC 2025, LNCS 16140, pp. 271-289 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05609 2026-01-12 cs.CL 74%

Data Augmented Pipeline for Legal Information Extraction and Reasoning

法律信息抽取与推理的数据增强管道

Nguyen Minh Phuong, Ha-Thanh Nguyen, May Myo Zin, Ken Satoh

机构 * Center for Juris-Informatics, ROIS-DS(司法信息中心,ROIS-DS) Japan Advanced Institute of Science and Technology(日本先进科学研究所) Research and Development Center for LLMs, NII(大语言模型研发中心,NII)

专题命中 其他推理 :reasoning(title);分类 cs.CL

AI总结 本文提出了一种基于大型语言模型的数据增强管道,用于提升法律领域信息抽取与推理的效率和鲁棒性,同时具备跨领域应用的通用性。

Comments Accepted in the Demonstration Track at ICAIL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05589 2026-01-12 cs.CL cs.AI 62%

ACR: Adaptive Context Refactoring via Context Refactoring Operators for Multi-Turn Dialogue

ACR: 通过上下文重构运算符进行多轮对话的自适应上下文重构

Jiawei Shen, Jia Zhu, Hanghui Guo, Weijie Shi, Yue Cui, Qingyu Niu, Guoqing Ma, Yidan Liang, Jingjiang Liu, Yiling Wang, Shimin Di, Jiajie Xu

机构 * Zhejiang Normal University(浙江师范大学) Alibaba Group(阿里巴巴集团) Hong Kong University of Science and Technology(香港科学与技术大学) Southeast University(东南大学) Soochow University(苏州大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 ACR通过动态上下文重构运算符和教师指导的自我进化训练范式,有效缓解多轮对话中的上下文惯性和状态漂移问题,提升对话性能并降低令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06107 2026-01-12 cs.SE cs.AI 57%

Towards AI-Native Software Engineering (SE 3.0): A Vision and a Challenge Roadmap

迈向AI原生软件工程(SE 3.0):愿景与挑战路线图

Ahmed E. Hassan, Gustavo A. Oliva, Dayi Lin, Boyuan Chen, Zhen Ming, Jiang

机构 * Queen's University(女王大学) Centre for Software Excellence, Huawei Canada(华为加拿大软件卓越中心) York University(约克大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SE 3.0愿景,通过AI原生方法提升软件开发效率,介绍关键技术栈与挑战路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05520 2026-01-12 cs.CL 57%

CHisAgent: A Multi-Agent Framework for Event Taxonomy Construction in Ancient Chinese Cultural Systems

CHisAgent:一种用于古代中国文化系统事件分类的多智能体框架

Xuemei Tang, Chengxi Yan, Jinghang Gu, Chu-Ren Huang

机构 * The Hong Kong Polytechnic University(香港理工大学) Renmin University of China(中国人民大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 CHisAgent通过多智能体框架实现古代中国历史事件的自动分类,提升历史知识组织与跨文化理解能力。

Comments 22 pages, 13 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05651 2026-01-12 cs.HC 50%

Productive Discussion Moves in Groups Addressing Controversial Issues

群体中针对争议性问题的 productive discussion moves

Kyuwon Kim, Jeanhee Lee, Sung-Eun Kim, Hyo-Jeong So

专题命中 其他推理 :reasoning(abstract)

AI总结 本研究通过分析人工智能伦理困境中的小组讨论,识别出14种有效讨论策略,并发现情感表达和明确承认模糊性对讨论质量有积极影响,而基于他人想法的构建则有消极影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05549 2026-01-12 cs.IR 50%

Efficient Temporal-aware Matryoshka Adaptation for Temporal Information Retrieval

高效的时间感知Matryoshka适应方法用于时间信息检索

Tuan-Luc Huynh, Weiqing Wang, Trung Le, Thuy-Trang Vu, Dragan Gašević, Yuan-Fang Li, Thanh-Toan Do

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出TMRL方法,通过时间感知Matryoshka嵌入提升时间信息检索效率,实现与传统方法相当的性能并支持灵活的精度-效率权衡。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05539 2026-01-12 cs.SE 50%

LIDL: LLM Integration Defect Localization via Knowledge Graph-Enhanced Multi-Agent Analysis

LIDL: 通过知识图谱增强的多智能体分析进行LLM集成缺陷定位

Gou Tan, Zilong He, Min Li, Pengfei Chen, Jieke Shi, Zhensu Sun, Ting Zhang, Danwen Chen, Lwin Khin Shar, Chuanfu Zhang, David Lo

专题命中 其他推理 :reasoning(abstract)

AI总结 LIDL通过知识图谱增强的多智能体分析,有效定位LLM集成软件中的缺陷,提升准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09896 2026-01-12 cs.CR 50%

ChatIoT: Large Language Model-based Security Assistant for Internet of Things with Retrieval-Augmented Generation

ChatIoT: 基于大语言模型的物联网安全助手与检索增强生成

Ye Dong, Yan Lin Aung, Sudipta Chattopadhyay, Jianying Zhou

专题命中 其他推理 :reasoning(abstract)

AI总结 ChatIoT是一种基于大语言模型的物联网安全助手,通过检索增强生成技术整合安全信息,提升用户在物联网安全实践中的指导与响应能力。

Comments preprint, under revision, 19 pages, 13 figures, 8 tables

Journal ref ACNS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏