arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-17 至 2026-02-17 共收录 360 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 74 篇

2602.14433 2026-02-17 cs.CY cs.AI cs.CL cs.HC 81%

Synthetic Reader Panels: Tournament-Based Ideation with LLM Personas for Autonomous Publishing

合成读者面板:基于比赛的创意生成与LLM角色用于自主出版

Fred Zimmerman

机构 * Nimble Books LLC(Nimble Books公司) Big Five Killer LLC(Big Five Killer公司)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 该研究提出利用合成读者面板进行自主出版,通过LLM角色模拟多样化读者进行比赛评估,有效识别内容问题并提升高质量概念比例。

Comments 5 tables, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14216 2026-02-17 cs.CY cs.AI cs.CL 81%

Reasoning Language Models for complex assessments tasks: Evaluating parental cooperation from child protection case reports

用于复杂评估任务的推理语言模型:从儿童保护案件报告中评估父母合作

Dragan Stoll, Brian E. Perron, Zia Qi, Selina Steinmann, Nicole F. Eicher, Andreas Jud

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究了推理语言模型在评估儿童保护案件中父母合作方面的有效性,发现模型在母亲合作评估上表现更佳,但对父亲合作的评估准确性较低,提示需关注性别差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20352 2026-02-17 cs.CL cs.AI 81%

Multi-LLM Thematic Analysis with Dual Reliability Metrics: Combining Cohen's Kappa and Semantic Similarity for Qualitative Research Validation

多LLM主题分析与双可靠性指标:结合Cohen's Kappa和语义相似性进行定性研究验证

Nilesh Jain, Hyungil Suh, Seyi Adeyinka, Leor Roseman, Aza Allsop

机构 * AZA Lab, Department of Psychiatry, Yale University(AZA实验室、精神病学系、耶鲁大学) Department of Psychiatry and Behavioral Sciences, Center for Collective Healing, Howard University(精神病学与行为科学系、集体愈合中心、霍华德大学) Department of Psychology, University of Exeter(心理学系、埃克塞特大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出一种结合Cohen's Kappa和语义相似性的多LLM主题分析框架,通过多轮验证提升定性研究的可靠性。

Comments 11 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13419 2026-02-17 q-bio.QM cs.AI cs.CL cs.LG q-bio.BM 80%

Protect$^*$: Steerable Retrosynthesis through Neuro-Symbolic State Encoding

Protect$^*$: 通过神经符号状态编码实现可操控的逆合成

Shreyas Vinaya Sathyanarayana, Shah Rahil Kirankumar, Sharanabasava D. Hiremath, Bharath Ramsundar

机构 * Deep Forest Sciences(深林科技) Departament de Farmacologia, Toxicologia i Química Terapèutica, Universitat de Barcelona(巴塞罗那大学药理学、毒理学与治疗化学系) Institut de Nanociència i Nanotecnologia IN2UB, Universitat de Barcelona(巴塞罗那大学纳米科学与纳米技术研究所)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Protect$^*$通过神经符号状态编码实现逆合成的可控生成,结合规则推理与神经模型,提升化学合成路径的可靠性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14749 2026-02-17 cs.CL 79%

Cognitive networks reconstruct mindsets about STEM subjects and educational contexts in almost 1000 high-schoolers, University students and LLM-based digital twins

认知网络重构了近1000名高中生、大学生和基于LLM的数字双胞胎对STEM学科和教育环境的看法

Francesco Gariboldi, Emma Franchino, Edith Haim, Gianluca Lattanzi, Alessandro Grecucci, Massimo Stella

机构 * Department of Psychology and Cognitive Science, University of Trento(心理学与认知科学系,特伦托大学) Department of Psychology and Communication, University of Bari(心理学与传播系,巴里大学) Department of Physics, University of Trento(物理学系,特伦托大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL

AI总结 本文通过认知网络分析揭示了不同群体对STEM学科的认知和情感差异,发现数学和统计学在高焦虑群体中表现出负面特征,而基于LLM的数字双胞胎在模拟文化态度时存在不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13103 2026-02-17 cs.LG 79%

R-Diverse: Mitigating Diversity Illusion in Self-Play LLM Training

R-Diverse: 缓解自博弈LLM训练中的多样性幻觉

Gengsheng Li, Jinghan He, Shijie Wang, Dan Zhang, Ruiqi Liu, Renrui Zhang, Zijun Yao, Junfeng Fang, Haiyun Guo, Jinqiao Wang

机构 * Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Wuhan AI Research(武汉人工智能研究所) National University of Singapore(新加坡国立大学) Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.LG

AI总结 R-Diverse通过引入记忆增强惩罚和技能感知测量,缓解自博弈LLM训练中的多样性幻觉问题,提升模型推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19228 2026-02-17 cs.LG 79%

Predicting the Order of Upcoming Tokens Improves Language Modeling

预测即将到来的令牌顺序改进语言建模

Zayd M. K. Zuhri, Erland Hilman Fuadi, Alham Fikri Aji

机构 * Mohamed Bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.LG

AI总结 通过学习排序损失预测令牌顺序,改进语言模型的下一个令牌预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07443 2026-02-17 cs.AI cs.GT 79%

Approximating Human Strategic Reasoning with LLM-Enhanced Recursive Reasoners Leveraging Multi-agent Hypergames

用LLM增强的递归推理器近似人类战略推理

Vince Trencsenyi, Agnieszka Mensfelt, Kostas Stathis

机构 * Royal Holloway University of London(伦敦皇家霍洛威大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出了一种基于LLM增强的递归推理器框架,通过多智能体超游戏模型评估LLM的递归推理能力,并展示了其在近似人类行为和最优解达成方面的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11047 2026-02-17 cs.RO cs.AI 79%

Enhancing Supermarket Robot Interaction: A Multi-Level LLM Conversational Interface for Handling Diverse Customer Intents

增强超市机器人交互:一种多层级LLM对话接口用于处理多样化客户意图

Chandran Nandkumar, Luka Peternel

机构 * Delft University of Technology(代尔夫特理工大学)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.AI

AI总结 本文提出多层级LLM接口提升超市机器人处理多样化客户意图的效率与性能。

Journal ref Frontiers in Robotics and AI, Volume 12, 1576348, April 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12522 2026-02-17 cs.SE cs.AI cs.IR cs.LG cs.MA 79%

Improved Bug Localization with AI Agents Leveraging Hypothesis and Dynamic Cognition

改进的AI代理在利用假设和动态认知进行Bug定位中的应用

Asif Mohammed Samir, Mohammad Masudur Rahman

机构 * Dalhousie University(达尔豪西大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出CogniGent技术,利用AI代理进行因果推理和动态认知调试,提升bug定位的准确性和效率。

Comments 13 pages, 7 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14979 2026-02-17 cs.RO 78%

RynnBrain: Open Embodied Foundation Models

RynnBrain: 开放式具身基础模型

Ronghao Dang, Jiayan Guo, Bohan Hou, Sicong Leng, Kehan Li, Xin Li, Jiangpin Liu, Yunxuan Mao, Zhikai Wang, Yuqian Yuan, Minghao Zhu, Xiao Lin, Yang Bai, Qian Jiang, Yaxi Zhao, Minghua Zeng, Junlong Gao, Yuming Jiang, Jun Cen, Siteng Huang, Liuyi Wang, Wenqiao Zhang, Chengju Liu, Jianfei Yang, Shijian Lu, Deli Zhao

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团)

专题命中 推理与问题求解 :foundation model(title,abstract)

AI总结 RynnBrain提出了一种开放的具身基础模型,通过统一框架强化感知、推理、规划等能力,显著优于现有模型,并能高效适应多种具身任务。

Comments Homepage: https://alibaba-damo-academy.github.io/RynnBrain.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10551 2026-02-17 cs.CV cs.AI 77%

C^2ROPE: Causal Continuous Rotary Positional Encoding for 3D Large Multimodal-Models Reasoning

C^2ROPE: 3D 大多模态模型推理中的因果连续旋转位置编码

Guanting Ye, Qiyan Zhao, Wenhao Yu, Xiaofeng Zhang, Jianmin Ji, Yanyong Zhang, Ka-Veng Yuen

机构 * State Key Laboratory of Internet of Things for Smart City, University of Macau(物联网智能城市国家重点实验室,澳门大学) Department of Automation, Shanghai Jiaotong University(上海交通大学自动化系) Institute of Advanced Technology, University of Science and Technology of China(中国科学技术大学先进技术研究院) School of Computer Science and Technology, USTC(中国科学技术大学计算机科学与技术学院) School of Artificial Intelligence and Data Science, USTC(中国科学技术大学人工智能与数据科学学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 C^2ROPE通过引入空间-时间连续位置编码和切比雪夫因果掩码,解决3D多模态模型中视觉特征连续性和因果关系建模问题。

Comments Accepted in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14166 2026-02-17 cs.CR cs.AI 77%

IntentMiner: Intent Inversion Attack via Tool Call Analysis in the Model Context Protocol

IntentMiner: 通过模型上下文协议中的工具调用分析进行意图倒置攻击

Yunhao Yao, Zhiqiang Wang, Haoran Cheng, Yihang Cheng, Haohua Du, Xiang-Yang Li

机构 * University of Science and Technology of China(中国科学技术大学) Beijing University of Aeronautics and Astronautics(北京航空航天大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 IntentMiner通过分析模型上下文协议中的工具调用,揭示了意图倒置攻击的机制,实现了超过85%的语义对齐,挑战了AI代理的隐私基础。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14456 2026-02-17 cs.LG 77%

Traceable Latent Variable Discovery Based on Multi-Agent Collaboration

基于多智能体协作的可追溯潜在变量发现

Huaming Du, Tao Hu, Yijie Huang, Yu Zhao, Guisong Liu, Tao Gu, Gang Kou, Carl Yang

机构 * Southwestern University of Finance and Economics(西南财经大学) Hunan University of Technology and Business(湖南工业大学) Xiangjiang Laboratory(湘江实验室) Emory University(埃默里大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 TLVD通过结合LLMs的元数据推理与TCDA的数据驱动建模,实现潜在变量及其语义的可追溯推断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11839 2026-02-17 cs.AI 77%

On the Eligibility of LLMs for Counterfactual Reasoning: A Decompositional Study

关于大型语言模型用于反事实推理的资格性:一种分解性研究

Shuai Yang, Qi Yang, Luoxi Tang, Yuqiao Meng, Nancy Guo, Jeremy Blackburn, Zhaohan Xi

机构 * Shuai Yang(1 阳帅) Qi Yang(2 杨琪)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种分解策略,分析LLMs在反事实推理中的表现,探讨不同任务和模态对性能的影响,以提升LLM推理系统的可靠性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13691 2026-02-17 cs.AI 77%

PhGPO: Pheromone-Guided Policy Optimization for Long-Horizon Tool Planning

PhGPO:基于信息素的策略优化用于长周期工具规划

Yu Li, Guangfeng Cai, Shengtian Yang, Han Luo, Shuo Han, Xu He, Dong Li, Lei Feng

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PhGPO通过学习历史轨迹中的信息素模式,指导策略优化以提升长周期工具规划能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13568 2026-02-17 cs.AI 77%

Who Do LLMs Trust? Human Experts Matter More Than Other LLMs

LLMs信任谁?人类专家比其他LLMs更重要

Anooshka Bajaj, Zoran Tiganj

机构 * Department of Computer Science, Indiana University Bloomington(计算机科学系,印第安纳大学布卢明顿分校) Department of Psychological and Brain Science, Indiana University Bloomington(心理学与脑科学系,印第安纳大学布卢明顿分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究LLMs在面对人类专家与其他LLMs反馈时的可信度影响,发现LLMs更倾向于信任人类专家的反馈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14974 2026-02-17 cs.RO 75%

DM0: An Embodied-Native Vision-Language-Action Model towards Physical AI

DM0:一种面向物理AI的具身原生视觉-语言-动作模型

En Yu, Haoran Lv, Jianjian Sun, Kangheng Lin, Ruitao Zhang, Yukang Shi, Yuyang Chen, Ze Chen, Ziheng Zhang, Fan Jia, Kaixin Liu, Meng Zhang, Ruitao Hao, Saike Huang, Songhan Xie, Yu Liu, Zhao Wu, Bin Xie, Pengwei Zhang, Qi Yang, Xianchi Deng, Yunfei Wei, Enwen Zhang, Hongyang Peng, Jie Zhao, Kai Liu, Wei Sun, Yajun Wei, Yi Yang, Yunqiao Zhang, Ziwei Yan, Haitao Yang, Hao Liu, Haoqiang Fan, Haowei Zhang, Junwen Huang, Yang Chen, Yunchao Ma, Yunhuan Yang, Zhengyuan Du, Ziming Liu, Jiahui Niu, Yucheng Zhao, Daxin Jiang, Wenbin Tang, Xiangyu Zhang, Zheng Ge, Erjin Zhou, Tiancai Wang

机构 * DM0 Team(DM0团队) Dexmal StepFun

专题命中 推理与问题求解 :language model(abstract);pretraining(abstract);post-training(abstract)

AI总结 DM0提出了一种面向物理AI的具身原生视觉-语言-动作模型,通过统一具身操作和导航,结合预训练、中训练和后训练流程,实现对复杂物理任务的高效处理。

Comments Authors are listed in alphabetical order. Code is available at https://github.com/Dexmal/dexbotic

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14689 2026-02-17 cs.CR cs.AI cs.CL cs.LG 75%

Exposing the Systematic Vulnerability of Open-Weight Models to Prefill Attacks

揭示开放权重模型对预填充攻击的系统性漏洞

Lukas Struppek, Adam Gleave, Kellin Pelrine

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究揭示了开放权重模型对预填充攻击的系统性漏洞,通过评估多种策略发现其普遍易受攻击,强调了加强防御的必要性。

Comments 54 pages, 7 figures, 35 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13962 2026-02-17 cs.SE 75%

CodeGlance: Understanding Code Reasoning Challenges in LLMs through Multi-Dimensional Feature Analysis

CodeGlance:通过多维特征分析理解LLM中的代码推理挑战

Yunkun Wang, Xuanhe Zhang, Junxiao Han, Chen Zhi, Shuiguang Deng

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 CodeGlance通过多维特征分析揭示LLM在代码推理中的挑战,发现未见过的函数推理对小型模型尤为困难,提出改进策略并提供开发指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13519 2026-02-17 math.GT math.SG 75%

Research Report: some constructions in Polyhedral Symplectic Topology suggested by AI

研究报告:由AI启发的多面体辛拓扑中的一些构造

Antonio Alfieri, Connor Novak

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本研究利用AI方法探索多面体辛拓扑中的构造问题,旨在解决Lagrangian光滑性相关的数学难题。

Comments The research report is being submitted before the decryption of the solutions. We will return on the manuscript to include further remarks. Comments are welcomed

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01784 2026-02-17 cs.CL cs.AI 73%

iQUEST: An Iterative Question-Guided Framework for Knowledge Base Question Answering

iQUEST: 一种迭代式问题引导的知识库问答框架

Shuai Wang, Yinan Yu

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 iQUEST通过迭代分解复杂查询和集成图神经网络,提升多跳知识库问答的推理准确性与连贯性。

Comments Accepted to the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025), Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14451 2026-02-17 cs.AI cs.CL 73%

Precedent-Informed Reasoning: Mitigating Overthinking in Large Reasoning Models via Test-Time Precedent Learning

基于先例的推理:通过测试时先例学习缓解大推理模型中的过度思考

Qianyue Wang, Jinwu Hu, Huanxiang Lin, Bolin Chen, Zhiquan Wen, Yaofo Chen, Yu Rong, Mingkui Tan

机构 * South China University of Technology(华南理工大学) Pazhou Laboratory(黄埔实验室) DAMO Academy(达摩院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PIR通过测试时先例学习,优化大推理模型的推理过程,减少冗余探索并提升准确率与效率的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18702 2026-02-17 cs.LG cs.AI cs.AR 73%

From Fuzzy to Exact: The Halo Architecture for Infinite-Depth Reasoning via Rational Arithmetic

从模糊到精确:通过有理算术的Halo架构实现无限深度推理

Hansheng Ren

机构 * Hansheng Ren(独立研究者)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 Halo架构通过有理算术实现无限深度推理,结合双环拓扑和精确推断单元,提升模型稳定性和效率,实现从模糊到精确的数学框架转型。

Comments Architecture update: Formalizes the Dual-Ring Topology and the Clean Transformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03669 2026-02-17 cs.LG cs.CL 73%

Token Hidden Reward: Steering Exploration-Exploitation in Group Relative Deep Reinforcement Learning

令牌隐藏奖励:在组相对深度强化学习中引导探索-利用

Wenlong Deng, Yi Ren, Yushu Li, Boying Gong, Danica J. Sutherland, Xiaoxiao Li, Christos Thrampoulidis

机构 * University of British Columbia(不列颠哥伦比亚大学) Vector Institute(向量研究所) Amii(阿米人工智能研究所) UC Berkeley(加州大学伯克利分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 令牌隐藏奖励通过调整组相对策略优化的学习信号,引导探索-利用平衡,提升大语言模型在推理任务中的表现。

Comments Full version of submission to 2nd AI for Math Workshop@ ICML 2025 (best paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20430 2026-02-17 cs.CL cs.AI cs.CV cs.MA 73%

An Agentic System for Rare Disease Diagnosis with Traceable Reasoning

一种具有可追溯推理的罕见病诊断代理系统

Weike Zhao, Chaoyi Wu, Yanjie Fan, Xiaoman Zhang, Pengcheng Qiu, Yuze Sun, Xiao Zhou, Yanfeng Wang, Xin Sun, Ya Zhang, Yongguo Yu, Kun Sun, Weidi Xie

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 DeepRare是一种基于大型语言模型的多代理系统,通过整合40多种专用工具和最新知识源,为罕见病诊断提供决策支持,实现了透明可追溯的推理链。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14740 2026-02-17 cs.AI cs.CY cs.GT 70%

AI Arms and Influence: Frontier Models Exhibit Sophisticated Reasoning in Simulated Nuclear Crises

人工智能武器与影响:前沿模型在模拟核危机中展现出复杂的推理能力

Kenneth Payne

机构 * King’s College London(伦敦国王学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过模拟核危机检验前沿AI模型的策略推理能力,发现其在复杂决策中展现出与人类相似的推理模式,但存在独特行为特征。

Comments 45 pages, 6 figures, 27 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14518 2026-02-17 cs.AI 70%

Diagnosing Knowledge Conflict in Multimodal Long-Chain Reasoning

多模态长链推理中的知识冲突诊断

Jing Tang, Kun Wang, Haolang Lu, Hongjin Chen, KaiTao Chen, Zhongxiang Sun, Qiankun Li, Lingjuan Lyu, Guoshun Nan, Zhigang Zeng

机构 * Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Renmin University of China(中国人民大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出了一种统一的知识冲突概念,揭示了多模态长链推理中不同冲突类型的特征和处理机制,为诊断和控制推理失败提供了原理性方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14083 2026-02-17 cs.AI 70%

Plan-MCTS: Plan Exploration for Action Exploitation in Web Navigation

Plan-MCTS:网页导航中的计划探索用于动作利用

Weiming Zhang, Jihong Wang, Jiamu Zhou, Qingyao Li, Xinbei Ma, Congmin Zheng, Xingyu Lou, Weiwen Liu, Zhuosheng Zhang, Jun Wang, Yong Yu, Weinan Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) OPPO Research Institute(OPPO研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Plan-MCTS通过将网页导航探索转移到语义计划空间,提升动作利用效率,实现更高效的导航任务执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14060 2026-02-17 cs.CL 70%

LM-Lexicon: Improving Definition Modeling via Harmonizing Semantic Experts

LM-Lexicon:通过和谐语义专家提升定义建模

Yang Liu, Jiaye Yang, Weikang Li, Jiahui Liang, Yang Li, Lingyong Yan

机构 * BIGAI Baidu Inc.(百度公司) Peking University(北京大学)

专题命中 推理与问题求解 :language model(abstract);small language model(abstract);分类 cs.CL

AI总结 LM-Lexicon通过语义专家学习和混合架构提升定义建模效果,实现BLEU分数提升7%,并优化领域级路由机制

Comments EACL 2026 (Oral), 22 pages, 12 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏