arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2025-12-01 至 2025-12-01 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 15 篇

2511.23031 2025-12-01 cs.CV cs.AI 83%

From Illusion to Intention: Visual Rationale Learning for Vision-Language Reasoning

从幻觉到意图:用于视觉-语言推理的视觉理由学习

Changpeng Wang, Haozhe Wang, Xi Chen, Junhan Liu, Taofeng Xue, Chong Peng, Donglian Qi, Fangzhen Lin, Yunfeng Yan

机构 * Zhejiang University(浙江大学) The University of Hong Kong(香港大学) Meituan(美团)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出视觉理由学习(ViRL),通过将视觉动作作为核心推理元素,提升视觉-语言推理模型的透明度和可信度。

Comments 19 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21743 2025-12-01 cs.CL 79%

Scaling Competence, Shrinking Reasoning: Cognitive Signatures in Language Model Learning

提升能力,缩减推理:语言模型学习中的认知特征

Mukul Singh, Ananya Singha, Arjun Radhakrishna, Sumit Gulwani

机构 * Microsoft(微软)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 该研究通过分析语言模型推理标记的动态变化,揭示了模型在任务学习中的能力发展过程,并提出相关指标用于优化训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01088 2025-12-01 cs.CL 79%

Privacy-Preserving Reasoning with Knowledge-Distilled Parametric Retrieval Augmented Generation

基于知识蒸馏的参数化检索增强生成隐私保护推理

Jinwen Chen, Hainan Zhang, Liang Pang, Yongxin Tong, Haibo Zhou, Yuan Zhan, Wei Lin, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Meituan(美团)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL

AI总结 DistilledPRAG通过知识蒸馏实现高效参数化RAG,提升隐私保护推理的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22351 2025-12-01 cs.CV 78%

INSIGHT: An Interpretable Neural Vision-Language Framework for Reasoning of Generative Artifacts

INSIGHT: 一种可解释的神经视觉-语言框架,用于生成性艺术作品的推理

Anshul Bagaria

机构 * Indian Institute of Technology, Madras, Tamil Nadu, India(印度理工学院Madras分校,泰米尔纳德州,印度)

专题命中 其他推理 :reasoning(title);chain-of-thought(abstract)

AI总结 INSIGHT提出了一种可解释的神经视觉-语言框架,通过多尺度定位、语义对齐和结构化提示协议,实现对生成性艺术作品的鲁棒检测与透明解释。

Comments 36 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22146 2025-12-01 cs.CL 70%

C$^2$DLM: Causal Concept-Guided Diffusion Large Language Models

C$^2$DLM: 基于因果概念的扩散大语言模型

Kairong Han, Nuanqiao Shan, Ziyu Zhao, Zijing Hu, Xinpeng Dong, Junjian Ye, Lujia Pan, Fei Wu, Kun Kuang

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Noah’s Ark Lab, Huawei Technologies(华为技术有限公司诺亚实验室)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL

AI总结 C$^2$DLM通过引入因果概念引导机制,提升大语言模型在推理任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20520 2025-12-01 cs.LG cs.CL 62%

Asymmetric REINFORCE for off-Policy Reinforcement Learning: Balancing positive and negative rewards

非对称REINFORCE用于离线策略强化学习:平衡正负奖励

Charles Arnal, Gaëtan Narozniak, Vivien Cabannes, Yunhao Tang, Julia Kempe, Remi Munos

机构 * FAIR at Meta(Meta 的 FAIR) Work done at Meta(Meta) NYU Courant Institute(纽约大学Courant研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本研究提出非对称REINFORCE算法,通过平衡正负奖励提升离线策略强化学习性能,理论分析表明基线下界可保证策略改进,并通过实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21748 2025-12-01 cs.CL cs.AI 62%

Building Domain-Specific Small Language Models via Guided Data Generation

通过引导数据生成构建领域专用小型语言模型

Aman Kumar, Ekant Muljibhai Amin, Xian Yeow Lee, Lasitha Vidyaratne, Ahmed K. Farahat, Dipanjan D. Ghosh, Yuta Koreeda, Chetan Gupta

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种通过引导数据生成构建领域专用小型语言模型的方法,结合领域适应预训练、监督微调和偏好优化,展示了在工业诊断任务中优于开源模型的性能。

Comments Accepted at Thirty-Eighth Annual Conference on Innovative Applications of Artificial Intelligence (IAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21736 2025-12-01 cs.CL cs.AI 62%

R2Q: Towards Robust 2-Bit Large Language Models via Residual Refinement Quantization

R2Q: 向通过残差细化量化实现稳健的2位大语言模型

Jiayi Chen, Jieqi Shi, Jing Huo, Chen Wu

机构 * Nanjing University(南京大学) Microsoft AI(微软人工智能)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 R2Q通过残差细化量化方法,在极端压缩下提升2位大语言模型的性能和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21725 2025-12-01 cs.CL cs.AI 62%

PromptTailor: Multi-turn Intent-Aligned Prompt Synthesis for Lightweight LLMs

PromptTailor: 为轻量级大语言模型进行多轮意图对齐的提示合成

Yizhou Xu, Janet Davis

机构 * Whitman College(惠特曼学院)

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 PromptTailor通过意图对齐的提示合成提升轻量级大语言模型的输出质量,以更少的模型调用次数实现更高的用户偏好率。

Comments EMNLP 2025 Workshop PALS. Additional note: There is a citation error on Evoke. The paper we are referring to is "Evoking critical thinking abilities in LLMs via reviewer-author prompt editing."

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09947 2025-12-01 cs.LG cs.AI 62%

EEGAgent: A Unified Framework for Automated EEG Analysis Using Large Language Models

EEGAgent: 一种利用大语言模型进行自动化EEG分析的统一框架

Sha Zhao, Mingyi Peng, Haiteng Jiang, Tao Li, Shijian Li, Gang Pan

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 EEGAgent利用大语言模型实现多任务EEG分析,提供灵活且可解释的自动化EEG处理与报告生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23122 2025-12-01 cs.AI 57%

Evolutionary Discovery of Heuristic Policies for Traffic Signal Control

进化发现交通信号控制的启发式策略

Ruibing Wang, Shuhan Guo, Zeen Li, Zhen Wang, Quanming Yao

机构 * Northwestern Polytechnical University, Xi'an, China(西北工业大学,西安) Tsinghua University, Beijing, China(清华大学,北京)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种基于大语言模型的交通信号控制策略进化方法,通过结构化状态抽象和信用分配反馈模块,生成针对特定交通环境的高效启发式策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09019 2025-12-01 cs.CL 57%

MedMobile: A mobile-sized language model with clinical capabilities

MedMobile: 一种具有临床能力的移动尺寸语言模型

Krithik Vishwanath, Jaden Stryker, Anton Alyakin, Daniel Alexander Alber, Eric Karl Oermann

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 MedMobile是一种移动尺寸的语言模型,通过高效的方法在医疗领域实现高性能表现,成为参数最少且性能最佳的临床应用模型。

Comments 24 pages, 7 figures (4 main, 3 supplementary)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21705 2025-12-01 cs.CL cs.CV 57%

Insight-A: Attribution-aware for Multimodal Misinformation Detection

Insight-A: 多模态虚假信息检测中的归因意识

Junjie Wu, Yumeng Fu, Chen Gong, Guohong Fu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) Institute of Artificial Intelligence, Soochow University(苏州大学人工智能研究院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Insight-A通过归因意识和分层推理提升多模态虚假信息检测效果,有效识别伪造来源并增强跨模态一致性检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21989 2025-12-01 cs.IR 50%

Selecting User Histories to Generate LLM Users for Cold-Start Item Recommendation

选择用户历史以生成LLM用户用于冷启动物品推荐

Nachiket Subbaraman, Jaskinder Sarai, Aniruddh Nath, Lichan Hong, Lukasz Heldt, Li Wei, Zhe Zhao

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出利用强化学习框架,通过策略选择用户历史以生成LLM用户,提升冷启动物品推荐性能。

Comments 12 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16897 2025-12-01 eess.AS 50%

Balancing Speech Understanding and Generation Using Continual Pre-training for Codec-based Speech LLM

通过持续预训练平衡基于编码器的语音LLM的语音理解和生成

Jiatong Shi, Chunlei Zhang, Jinchuan Tian, Junrui Ni, Hao Zhang, Shinji Watanabe, Dong Yu

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出通过持续预训练框架平衡基于编码器的语音LLM的语音理解和生成,实现端到端的语音翻译系统,无需中间转录和翻译步骤。

Comments Accepted by ASRU2025

详情

展开后加载摘要…

URL PDF HTML 收藏