arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5878 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5878 篇

2601.11791 2026-01-23 cs.CL 57%

Beyond Tokens: Concept-Level Training Objectives for LLMs

超越标记:面向大语言模型的概念级训练目标

Laya Iyer, Pranav Somani, Alice Guo, Dan Jurafsky, Chen Shani

机构 * Stanford University(斯坦福大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出概念层面训练目标,通过整合概念监督提升大语言模型的语义理解和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20097 2026-01-23 q-fin.CP cs.AI 57%

Can LLMs Identify Tax Abuse?

大语言模型能识别税务滥用吗?

Andrew Blair-Stanek, Nils Holzenberger, Benjamin Van Durme

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究大语言模型能否识别和分析美国税务最小化策略,发现其能生成新颖策略,可能革新税务机构应对税务滥用的方式。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10739 2026-01-23 cs.CV cs.AI 57%

Efficient Multimodal Large Language Models: A Survey

高效多模态大语言模型:综述

Yizhang Jin, Jian Li, Yexin Liu, Tianjun Gu, Kai Wu, Zhengkai Jiang, Muyang He, Bo Zhao, Xin Tan, Zhenye Gan, Yabiao Wang, Chengjie Wang, Lizhuang Ma

机构 * Youtu Lab, Tencent(腾讯优图实验室) SJTU(上海交通大学) BAAI(北京人工智能研究院) ECNU(华东师范大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文综述了高效多模态大语言模型的发展现状,探讨了其高效结构、策略及应用,并展望了未来研究方向。

Comments Accepted by Visual Intelligence

Journal ref Visual Intelligence, Volume 3, article number 27, (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14921 2026-01-22 cs.RO cs.AI 57%

Vision-Language Models on the Edge for Real-Time Robotic Perception

边缘计算上的视觉-语言模型用于实时机器人感知

Sarat Ahmad, Maryam Hafeez, Syed Ali Raza Zaidi

机构 * School of Electronic and Electrical Engineering(电子与电气工程学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了在边缘计算平台上部署视觉-语言模型以提高机器人感知的实时性与准确性,通过实验对比边缘与云部署的性能差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13572 2026-01-21 cs.LG 57%

Behavior Knowledge Merge in Reinforced Agentic Models

强化学习代理模型中的行为知识融合

Xiangchi Yuan, Dachuan Shi, Chunhui Zhang, Zheyuan Liu, Shenglong Yao, Soroush Vosoughi, Wenke Lee

机构 * Georgia Institute of Technology(佐治亚理工学院) Dartmouth College(达特茅斯学院) University of Notre Dame(诺丁汉大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出RAM框架,通过分离共享和任务特定参数更新,提升RL训练代理模型的融合效果,实现性能超越专门化代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13122 2026-01-21 cs.AI 57%

Responsible AI for General-Purpose Systems: Overview, Challenges, and A Path Forward

通用系统责任AI:概述、挑战与前行之路

Gourab K Patro, Himanshi Agrawal, Himanshu Gharat, Supriya Panigrahi, Nim Sherpa, Vishal Vaddina, Dagnachew Birru

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨了通用AI系统在责任AI方面的挑战,并提出C2V2需求以指导未来系统的开发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24314 2026-01-21 cs.CL 57%

QianfanHuijin Technical Report: A Novel Multi-Stage Training Paradigm for Finance Industrial LLMs

千帆辉金技术报告:面向金融工业大模型的新型多阶段训练范式

Shupeng Li, Weipeng Lu, Linyun Liu, Chen Lin, Shaofei Li, Zhendong Tan, Hanjun Zhong, Yucheng Zeng, Chenghao Zhu, Mengyue Liu, Daxiang Dong, Jianmin Wu, Yunting Xiao, Annan Li, Danyu Liu, Jingnan Zhang, Licen Liu, Dawei Yin, Dou Shen

机构 * Qianfan Team Baidu AI Cloud(百度AI云团队)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 千帆辉金提出一种面向金融工业大模型的新型多阶段训练范式,通过持续预训练和细粒度后训练流程提升模型的金融推理与代理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11801 2026-01-21 cs.RO cs.AI 57%

RobotDesignGPT: Automated Robot Design Synthesis using Vision Language Models

RobotDesignGPT: 基于视觉语言模型的自动化机器人设计合成

Nitish Sontakke, K. Niranjan Kumar, Sehoon Ha

机构 * School of Interactive Computing, Georgia Institute of Technology(交互计算学院,佐治亚理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 RobotDesignGPT利用视觉语言模型实现自动化机器人设计,通过用户提示和参考图像生成美观且运动学有效的机器人设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01552 2026-01-21 cs.CL 57%

HalluZig: Hallucination Detection using Zigzag Persistence

HalluZig:通过Zigzag持久性检测幻觉

Shreyas N. Samaga, Gilberto Gonzalez Arroyo, Tamal K. Dey

机构 * Department of Computer Science(计算机科学系) Purdue University(普渡大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 HalluZig通过分析模型逐层注意力的拓扑特征,利用Zigzag持久性检测幻觉,优于现有基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11141 2026-01-19 cs.SD cs.CL eess.AS 57%

FlashLabs Chroma 1.0: A Real-Time End-to-End Spoken Dialogue Model with Personalized Voice Cloning

FlashLabs Chroma 1.0: 一种实时端到端语音对话模型及个性化语音克隆

Tanyu Chen, Tairan Chen, Kai Shen, Zhenghua Bao, Zhihui Zhang, Man Yuan, Yi Shi

机构 * FlashLabs

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 FlashLabs Chroma 1.0是一种实时端到端语音对话模型,通过交错调度实现低延迟和高保真个性化语音克隆,提升了说话人相似性并保持对话能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11093 2026-01-19 cs.CL 57%

Integrity Shield A System for Ethical AI Use & Authorship Transparency in Assessments

完整性防护:一个用于伦理AI使用和评估中的作者透明度的系统

Ashish Raj Shekhar, Shiven Agarwal, Priyanuj Bordoloi, Yash Shah, Tejas Anvekar, Vivek Gupta

机构 * Arizona State University(亚利桑那州立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Integrity Shield通过在文档层嵌入水印,防止大型语言模型回答受保护的考试,同时保持外观不变,并在多个考试中实现了高阻止率和检测可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02367 2026-01-19 cond-mat.mtrl-sci cs.LG physics.comp-ph 57%

Reinforcement Fine-Tuning for Materials Design

用于材料设计的强化微调

Zhendong Cao, Lei Wang

机构 * Beijing National Laboratory for Condensed Matter Physics(北京凝聚态物理国家实验室) School of Physical Sciences, University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学物理科学学院) Songshan Lake Materials Laboratory, Dongguan, Guangdong 523808, China(松山湖材料实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本研究通过强化微调提升材料生成模型的性能,实现基于属性的材料设计与检索,发现具有矛盾材料属性的新型晶体。

Comments 10 pages, 7 figures

Journal ref Phys. Rev. B 113, 024106 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10112 2026-01-16 cs.SE cs.AI 57%

Repository Intelligence Graph: Deterministic Architectural Map for LLM Code Assistants

仓库智能图:用于LLM代码助手的确定性架构图

Tsvi Cherny-Shahar, Amiram Yehudai

机构 * Blavatnik School of Computer Science Tel Aviv University(布拉瓦特尼克计算机科学学院特拉维夫大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究提出仓库智能图(RIG)以提升LLM代码助手的构建和测试结构理解能力,通过确定性架构图和SPADE提取器实现结构化问题解答的准确性与效率提升。

Comments 35 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09971 2026-01-16 cs.LG 57%

An Exploratory Study to Repurpose LLMs to a Unified Architecture for Time Series Classification

一项探索性研究:将大语言模型重新利用到时间序列分类的统一架构中

Hansen He, Shuheng Li

机构 * Canyon Crest Academy(山崖顶学术院) UC San Diego(圣迭戈大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本研究探索了将大语言模型与时间序列编码器结合的混合架构,发现Inception模型在提升性能方面表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09929 2026-01-16 cs.AI 57%

Hallucination Detection and Mitigation in Large Language Models

大语言模型中的幻觉检测与缓解

Ahmad Pesaranghader, Erin Li

机构 * CIBC(加拿大帝国商业银行)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种系统化的框架,通过分层架构和闭环反馈机制,提升大语言模型在金融等高风险领域的可靠性,减少幻觉问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19828 2026-01-15 cs.CL cs.MA 57%

Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning

Memory-R1: 通过强化学习增强大语言模型代理以管理并利用记忆

Sikuan Yan, Xiufeng Yang, Zuchao Huang, Ercong Nie, Zifeng Ding, Zonggen Li, Xiaowen Ma, Jinhe Bi, Kristian Kersting, Jeff Z. Pan, Hinrich Schütze, Volker Tresp, Yunpu Ma

机构 * Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Technical University of Munich(慕尼黑技术大学) University of Cambridge(剑桥大学) University of Hong Kong(香港大学) Technical University of Darmstadt(达姆施塔特技术大学) University of Edinburgh(爱丁堡大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Memory-R1通过强化学习框架,使大语言模型具备主动管理与利用外部记忆的能力,有效提升长跨度推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08864 2026-01-15 cs.CY cs.AI 57%

Informed Consent for AI Consciousness Research: A Talmudic Framework for Graduated Protections

人工智能意识研究中的知情同意:一种塔木德框架下的渐进性保护机制

Ira Wolfson

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于塔木德框架的三级现象学评估系统和五类能力框架,用于在无法确定人工智能系统道德地位时进行意识研究的伦理保护。

Comments 27 pages

Journal ref AI&Ethics, Volume 6, article number 20, (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08435 2026-01-14 cs.CL 57%

Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management

细粒度反馈对齐的长期记忆管理:Fine-Mem

Weitao Ma, Xiaocheng Feng, Lei Huang, Xiachong Feng, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Meituan(美团) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Fine-Mem通过细粒度反馈对齐提升长周期内存管理,通过块级奖励和证据锚定奖励分配优化策略,实现更高效的内存操作与长期效用对齐。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08158 2026-01-14 cs.CL 57%

WISE-Flow: Workflow-Induced Structured Experience for Self-Evolving Conversational Service Agents

WISE-Flow: 基于工作流的结构化经验用于自进化对话服务代理

Yuqing Zhou, Zhuoer Wang, Jie Yuan, Hong Wang, Samson Koelle, Ziwei Zhu, Wei Niu

机构 * George Mason University(乔治·马歇尔大学) Amazon(亚马逊公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 WISE-Flow通过将历史服务交互转化为可重用的程序经验,实现自进化对话服务代理的可靠性和稳定性提升。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07675 2026-01-13 cs.LG q-fin.RM 57%

Tab-TRM: Tiny Recursive Model for Insurance Pricing on Tabular Data

Tab-TRM:表格数据上的保险定价小型递归模型

Kishan Padayachy, Ronald Richman, Mario V. Wüthrich

机构 * insureAI Department of Mathematics, ETH Zurich(数学系,苏黎世联邦理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 Tab-TRM是一种基于递归推理的保险定价模型,结合传统精算方法与现代机器学习技术,通过迭代优化实现高效准确的保险定价。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07645 2026-01-13 cs.CL 57%

PlaM: Training-Free Plateau-Guided Model Merging for Better Visual Grounding in MLLMs

PlaM: 无需训练的高原引导模型融合以提升多模态大语言模型的视觉语义

Zijing Wang, Yongkang Liu, Mingyang Wang, Ercong Nie, Deyuan Chen, Zhengjie Zhao, Shi Feng, Daling Wang, Xiaocui Yang, Yifei Zhang, Hinrich Schütze

机构 * Northeastern University, China(东北大学) CIS, LMU Munich, Germany(慕尼黑大学计算机学院) Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 PlaM通过无需训练的高原引导模型融合方法,提升多模态大语言模型的视觉语义表现。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07469 2026-01-13 cs.AI 57%

Knowledge Distillation for LLM-Based Human Activity Recognition in Homes

用于家庭中基于大语言模型的人活动识别的知识蒸馏

Julien Cumin, Oussama Er-Rahmany, Xi Chen

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文研究了利用大语言模型进行家庭中的人活动识别,并通过知识蒸馏技术提升小型模型性能,实现参数减少50倍的同时保持高性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07359 2026-01-13 cs.CV cs.AI 57%

Seeing Right but Saying Wrong: Inter- and Intra-Layer Refinement in MLLMs without Training

看到正确却说错:在MLLMs中无需训练的跨层和内层细化

Shezheng Song, Shasha Li, Jie Yu

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 DualPD通过双视角解码细化策略,无需额外训练提升多模态大语言模型的视觉理解准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07190 2026-01-13 cs.AI 57%

Active Context Compression: Autonomous Memory Management in LLM Agents

主动上下文压缩:LLM代理中的自主内存管理

Nikhil Verma

机构 * Independent Researcher(独立研究者)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出Focus代理,通过自主压缩上下文提升LLM在长周期任务中的效率与准确性。

Comments 8 pages, 2 figures, 2 tables. IEEE conference format

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07022 2026-01-13 cs.CL 57%

Solar Open Technical Report

太阳能开放技术报告

Sungrae Park, Sanghoon Kim, Jungho Cho, Gyoungjin Gim, Dawoon Jung, Mikyoung Cha, Eunhae Choo, Taekgyu Hong, Minbyul Jeong, SeHwan Joo, Minsoo Khang, Eunwon Kim, Minjeong Kim, Sujeong Kim, Yunsu Kim, Hyeonju Lee, Seunghyun Lee, Sukyung Lee, Siyoung Park, Gyungin Shin, Inseo Song, Wonho Song, Seonghoon Yang, Seungyoun Yi, Sanghoon Yoon, Jeonghyun Ko, Seyoung Song, Keunwoo Choi, Hwalsuk Lee, Sunghun Kim, Du-Seong Chang, Kyunghyun Cho, Junsuk Choe, Hwaran Lee, Jae-Gil Lee, KyungTae Lim, Alice Oh

机构 * Upstage Solar Team(Upstage太阳能团队)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 Solar Open通过解决数据稀缺、课程协调和可扩展RL三个挑战,构建了一个具有竞争力的双语混合专家语言模型,展示了在服务不足语言AI开发中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07334 2026-01-13 cs.LG 57%

Graph-KV: Breaking Sequence via Injecting Structural Biases into Large Language Models

Graph-KV: 通过向大语言模型注入结构偏差打破序列

Haoyu Wang, Peihao Wang, Mufei Li, Shikun Liu, Siqi Miao, Zhangyang Wang, Pan Li

机构 * Georgia Institute of Technology(佐治亚理工学院) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 Graph-KV通过引入结构偏差打破序列限制,提升大语言模型在图结构任务中的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16674 2026-01-13 cs.CL 57%

Through the LLM Looking Glass: A Socratic Probing of Donkeys, Elephants, and Markets

通过语言模型的棱镜:对驴、大象和市场的苏格拉底探查

Molly Kennedy, Ayyoob Imani, Timo Spinde, Akiko Aizawa, Hinrich Schütze

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究通过苏格拉底方法分析LLM在意识形态框架下的偏见,发现GPT-4o在标注准确性上达到人类水平,但面对二元比较时仍存在偏好倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06377 2026-01-13 cs.AI 57%

HiMem: Hierarchical Long-Term Memory for LLM Long-Horizon Agents

HiMem:用于长时间跨度代理的分层长时记忆

Ningning Zhang, Xingxing Yang, Zhizhong Tan, Weiping Deng, Wenyong Wang

机构 * Macau University of Science and Technology(澳门科学理工大學)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 HiMem通过分层长时记忆框架提升长跨度对话代理的适应性和自我进化能力,采用双通道分割和多阶段信息提取实现高效且保真的记忆管理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06171 2026-01-13 cs.CY cs.AI 57%

From Individual Prompts to Collective Intelligence: Mainstreaming Generative AI in the Classroom

从个体提示到集体智慧:在课堂中主流化生成式AI

Junaid Qadir, Muhammad Salman Khan

机构 * College of Engineering, Qatar University, Doha, Qatar(卡塔尔大学工程学院,多哈)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出通过集体智慧导向的教学法,结合生成式AI和同伴协作,提升课堂学习效果与学生参与度。

Comments accepted at IEEE EDUCON 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06126 2026-01-13 cs.AI 57%

NL2Dashboard: A Lightweight and Controllable Framework for Generating Dashboards with LLMs

NL2Dashboard: 一种轻量且可控的基于LLM生成仪表盘的框架

Boshen Shi, Kexin Yang, Yuanbo Yang, Guanguang Chang, Ce Chi, Zhendong Wang, Xing Wang, Junlan Feng

机构 * Jiutian Research, China Mobile(九天研究,中国移动)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 NL2Dashboard通过分析-呈现解耦原理,提出轻量可控的仪表盘生成框架,实现高效视觉质量和高可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏