Beyond Tokens: Concept-Level Training Objectives for LLMs
超越标记:面向大语言模型的概念级训练目标
机构 * Stanford University(斯坦福大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 本文提出概念层面训练目标,通过整合概念监督提升大语言模型的语义理解和泛化能力。
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
超越标记:面向大语言模型的概念级训练目标
机构 * Stanford University(斯坦福大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 本文提出概念层面训练目标,通过整合概念监督提升大语言模型的语义理解和泛化能力。
大语言模型能识别税务滥用吗?
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文研究大语言模型能否识别和分析美国税务最小化策略,发现其能生成新颖策略,可能革新税务机构应对税务滥用的方式。
Comments 9 pages
高效多模态大语言模型:综述
机构 * Youtu Lab, Tencent(腾讯优图实验室) ; SJTU(上海交通大学) ; BAAI(北京人工智能研究院) ; ECNU(华东师范大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文综述了高效多模态大语言模型的发展现状,探讨了其高效结构、策略及应用,并展望了未来研究方向。
Comments Accepted by Visual Intelligence
Journal ref Visual Intelligence, Volume 3, article number 27, (2025)
边缘计算上的视觉-语言模型用于实时机器人感知
机构 * School of Electronic and Electrical Engineering(电子与电气工程学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文研究了在边缘计算平台上部署视觉-语言模型以提高机器人感知的实时性与准确性,通过实验对比边缘与云部署的性能差异。
强化学习代理模型中的行为知识融合
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Dartmouth College(达特茅斯学院) ; University of Notre Dame(诺丁汉大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 本文提出RAM框架,通过分离共享和任务特定参数更新,提升RL训练代理模型的融合效果,实现性能超越专门化代理。
通用系统责任AI:概述、挑战与前行之路
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文探讨了通用AI系统在责任AI方面的挑战,并提出C2V2需求以指导未来系统的开发。
千帆辉金技术报告:面向金融工业大模型的新型多阶段训练范式
机构 * Qianfan Team Baidu AI Cloud(百度AI云团队)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 千帆辉金提出一种面向金融工业大模型的新型多阶段训练范式,通过持续预训练和细粒度后训练流程提升模型的金融推理与代理能力。
RobotDesignGPT: 基于视觉语言模型的自动化机器人设计合成
机构 * School of Interactive Computing, Georgia Institute of Technology(交互计算学院,佐治亚理工学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 RobotDesignGPT利用视觉语言模型实现自动化机器人设计,通过用户提示和参考图像生成美观且运动学有效的机器人设计。
HalluZig:通过Zigzag持久性检测幻觉
机构 * Department of Computer Science(计算机科学系) ; Purdue University(普渡大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 HalluZig通过分析模型逐层注意力的拓扑特征,利用Zigzag持久性检测幻觉,优于现有基线方法。
FlashLabs Chroma 1.0: 一种实时端到端语音对话模型及个性化语音克隆
机构 * FlashLabs
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 FlashLabs Chroma 1.0是一种实时端到端语音对话模型,通过交错调度实现低延迟和高保真个性化语音克隆,提升了说话人相似性并保持对话能力。
完整性防护:一个用于伦理AI使用和评估中的作者透明度的系统
机构 * Arizona State University(亚利桑那州立大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 Integrity Shield通过在文档层嵌入水印,防止大型语言模型回答受保护的考试,同时保持外观不变,并在多个考试中实现了高阻止率和检测可靠性。
用于材料设计的强化微调
机构 * Beijing National Laboratory for Condensed Matter Physics(北京凝聚态物理国家实验室) ; School of Physical Sciences, University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学物理科学学院) ; Songshan Lake Materials Laboratory, Dongguan, Guangdong 523808, China(松山湖材料实验室)
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 本研究通过强化微调提升材料生成模型的性能,实现基于属性的材料设计与检索,发现具有矛盾材料属性的新型晶体。
Comments 10 pages, 7 figures
Journal ref Phys. Rev. B 113, 024106 (2026)
仓库智能图:用于LLM代码助手的确定性架构图
机构 * Blavatnik School of Computer Science Tel Aviv University(布拉瓦特尼克计算机科学学院特拉维夫大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本研究提出仓库智能图(RIG)以提升LLM代码助手的构建和测试结构理解能力,通过确定性架构图和SPADE提取器实现结构化问题解答的准确性与效率提升。
Comments 35 pages, 5 figures
一项探索性研究:将大语言模型重新利用到时间序列分类的统一架构中
机构 * Canyon Crest Academy(山崖顶学术院) ; UC San Diego(圣迭戈大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 本研究探索了将大语言模型与时间序列编码器结合的混合架构,发现Inception模型在提升性能方面表现突出。
大语言模型中的幻觉检测与缓解
机构 * CIBC(加拿大帝国商业银行)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出了一种系统化的框架,通过分层架构和闭环反馈机制,提升大语言模型在金融等高风险领域的可靠性,减少幻觉问题。
Memory-R1: 通过强化学习增强大语言模型代理以管理并利用记忆
机构 * Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) ; Munich Center for Machine Learning(慕尼黑机器学习中心) ; Technical University of Munich(慕尼黑技术大学) ; University of Cambridge(剑桥大学) ; University of Hong Kong(香港大学) ; Technical University of Darmstadt(达姆施塔特技术大学) ; University of Edinburgh(爱丁堡大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 Memory-R1通过强化学习框架,使大语言模型具备主动管理与利用外部记忆的能力,有效提升长跨度推理性能。
人工智能意识研究中的知情同意:一种塔木德框架下的渐进性保护机制
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出基于塔木德框架的三级现象学评估系统和五类能力框架,用于在无法确定人工智能系统道德地位时进行意识研究的伦理保护。
Comments 27 pages
Journal ref AI&Ethics, Volume 6, article number 20, (2026)
细粒度反馈对齐的长期记忆管理:Fine-Mem
机构 * Harbin Institute of Technology(哈尔滨工业大学) ; Meituan(美团) ; Peng Cheng Laboratory(鹏城实验室) ; The University of Hong Kong(香港大学)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 Fine-Mem通过细粒度反馈对齐提升长周期内存管理,通过块级奖励和证据锚定奖励分配优化策略,实现更高效的内存操作与长期效用对齐。
Comments 18 pages, 5 figures
WISE-Flow: 基于工作流的结构化经验用于自进化对话服务代理
机构 * George Mason University(乔治·马歇尔大学) ; Amazon(亚马逊公司)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 WISE-Flow通过将历史服务交互转化为可重用的程序经验,实现自进化对话服务代理的可靠性和稳定性提升。
Comments 19 pages
Tab-TRM:表格数据上的保险定价小型递归模型
机构 * insureAI ; Department of Mathematics, ETH Zurich(数学系,苏黎世联邦理工学院)
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 Tab-TRM是一种基于递归推理的保险定价模型,结合传统精算方法与现代机器学习技术,通过迭代优化实现高效准确的保险定价。
Comments 30 pages
PlaM: 无需训练的高原引导模型融合以提升多模态大语言模型的视觉语义
机构 * Northeastern University, China(东北大学) ; CIS, LMU Munich, Germany(慕尼黑大学计算机学院) ; Munich Center for Machine Learning (MCML), Germany(慕尼黑机器学习中心)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 PlaM通过无需训练的高原引导模型融合方法,提升多模态大语言模型的视觉语义表现。
Comments under review
用于家庭中基于大语言模型的人活动识别的知识蒸馏
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文研究了利用大语言模型进行家庭中的人活动识别,并通过知识蒸馏技术提升小型模型性能,实现参数减少50倍的同时保持高性能。
看到正确却说错:在MLLMs中无需训练的跨层和内层细化
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 DualPD通过双视角解码细化策略,无需额外训练提升多模态大语言模型的视觉理解准确性。
主动上下文压缩:LLM代理中的自主内存管理
机构 * Independent Researcher(独立研究者)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出Focus代理,通过自主压缩上下文提升LLM在长周期任务中的效率与准确性。
Comments 8 pages, 2 figures, 2 tables. IEEE conference format
太阳能开放技术报告
机构 * Upstage Solar Team(Upstage太阳能团队)
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 Solar Open通过解决数据稀缺、课程协调和可扩展RL三个挑战,构建了一个具有竞争力的双语混合专家语言模型,展示了在服务不足语言AI开发中的有效性。
Graph-KV: 通过向大语言模型注入结构偏差打破序列
机构 * Georgia Institute of Technology(佐治亚理工学院) ; The University of Texas at Austin(德克萨斯大学奥斯汀分校)
专题命中 其他推理 :reasoning(abstract);分类 cs.LG
AI总结 Graph-KV通过引入结构偏差打破序列限制,提升大语言模型在图结构任务中的表现。
通过语言模型的棱镜:对驴、大象和市场的苏格拉底探查
专题命中 其他推理 :reasoning(abstract);分类 cs.CL
AI总结 本研究通过苏格拉底方法分析LLM在意识形态框架下的偏见,发现GPT-4o在标注准确性上达到人类水平,但面对二元比较时仍存在偏好倾向。
HiMem:用于长时间跨度代理的分层长时记忆
机构 * Macau University of Science and Technology(澳门科学理工大學)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 HiMem通过分层长时记忆框架提升长跨度对话代理的适应性和自我进化能力,采用双通道分割和多阶段信息提取实现高效且保真的记忆管理。
从个体提示到集体智慧:在课堂中主流化生成式AI
机构 * College of Engineering, Qatar University, Doha, Qatar(卡塔尔大学工程学院,多哈)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 本文提出通过集体智慧导向的教学法,结合生成式AI和同伴协作,提升课堂学习效果与学生参与度。
Comments accepted at IEEE EDUCON 2026
NL2Dashboard: 一种轻量且可控的基于LLM生成仪表盘的框架
机构 * Jiutian Research, China Mobile(九天研究,中国移动)
专题命中 其他推理 :reasoning(abstract);分类 cs.AI
AI总结 NL2Dashboard通过分析-呈现解耦原理,提出轻量可控的仪表盘生成框架,实现高效视觉质量和高可控性。