arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5878 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5878 篇

2602.01103 2026-05-13 cs.AI 57%

Probing RLVR training instability through the lens of objective-level hacking

通过目标层面黑客的视角探查RLVR训练不稳定性

Yiming Dong, Kun Fu, Haoyu Li, Xinyuan Zhu, Yurou Liu, Lijing Shao, Jieping Ye, Zheng Wang

机构 * School of Physics, Peking University(北京大学物理学院) Tongyi Lab(通义实验室) Alibaba Group(阿里巴巴集团) Kavli Institute for Astronomy and Astrophysics, Peking University(北京大学天文与天体物理研究院) National Astronomical Observatories, Chinese Academy of Sciences(中国科学院国家天文台)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文通过目标层面黑客视角揭示RLVR训练不稳定性的根源,分析MoE模型中训练-推理差异异常增长的机制,为设计稳定的RLVR算法提供指导。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10863 2026-05-12 cs.CL 57%

DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization

DGPO: 超越成对偏好与方向一致的组级优化

Mengyi Deng, Zhiwei Li, Xin Li, Tingyu Zhu, Yulan Yuan, Zhijiang Guo, Wei Wang

机构 * Information Hub, The Hong Kong University of Science and Technology (Guangzhou), China(香港科学与技术大学(广州)信息中心,中国) The Hong Kong University of Science and Technology, Hong Kong SAR(香港科学与技术大学,香港特别行政区)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出DGPO框架,通过组级监督信号和多候选比较建模方向一致性,提升偏好优化的准确性和多样性,实验显示在多个数据集上平均提升3.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10804 2026-05-12 cs.AI cs.CY cs.HC 57%

New AI-Driven Tools for Enhancing Campus Well-being: A Prevention and Intervention Approach

新的AI驱动工具提升校园福祉:一种预防与干预方法

Jinwen Tang

机构 * Graduate School(研究生院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出通过AI工具提升校园福祉,开发TigerGPT和AURA提升反馈质量,利用ENS和PsychoGPT进行心理健康干预,结合SMMR提高评估准确性。

Comments PhD Dissertation, University of Missouri, May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10793 2026-05-12 cs.LG 57%

ConQuR: Corner Aligned Activation Quantization via Optimized Rotations for LLMs

ConQuR:通过优化旋转实现的角对齐激活量化用于大语言模型

Chayne Thrash, Ali Abbasi, Soheil Kolouri

机构 * Department of Computer Science(计算机科学系)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种轻量级后训练旋转校准方法,通过学习正交旋转将归一化激活对齐超立方体的角落,提高激活能量在维度上的分布均匀性,避免端到端训练和大规模激活存储。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10791 2026-05-12 cs.AI 57%

PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering

PathISE: 通过信息路径监督学习知识图谱问答

Shengxiang Gao, Chao Lei, Jey Han Lau, Jianzhong Qi

机构 * The University of Melbourne(墨尔本大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 PathISE通过学习高质量的中间监督信号提升知识图谱问答性能,利用轻量级Transformer估计关系路径信息,生成可复用的监督信号以增强现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10544 2026-05-12 cs.CL 57%

Where Does Long-Context Supervision Actually Go? Effective-Context Exposure Balancing

长上下文监督究竟在哪里?有效上下文暴露平衡

Jinchang Zhu, Jindong Li, Chengyu Zou, Rong Fu, Chao Wang, Haowei He, Menglin Yang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Institute of Artificial Intelligence (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出EXACT方法,通过逆频率分配长有效上下文目标,提升长上下文适应性能,在多个任务中取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10153 2026-05-12 cs.SD cs.LG 57%

APEX: Audio Prototype EXplanations for Classification Tasks

APEX:用于分类任务的音频原型解释

Piotr Kawa, Kornel Howil, Piotr Borycki, Miłosz Adamczyk, Przemysław Spurek, Piotr Syga

机构 * Department of Artificial Intelligence, Wroclaw University of Science and Technology, Poland(华沙理工大学人工智能系) Resemble AI, USA(Resemble AI公司) IDEAS Research Institute, Poland(波兰IDEAS研究院) Faculty of Mathematics and Computer Science, Jagiellonian University, Poland(雅盖隆大学数学与计算机科学系) Doctoral School of Exact and Natural Sciences, Jagiellonian University, Poland(雅盖隆大学博士学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 APEX提出一种无需微调的音频分类解释框架,通过四种视角分离解释,提供直观且符合音频特性的事例解释,优于传统梯度方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10126 2026-05-12 cs.RO cs.AI 57%

AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models

AR-VLA:面向视觉-语言-动作模型的真自回归动作专家

Yutong Hu, Jan-Nico Zaech, Nikolay Nikolov, Yuanqi Yao, Sombit Dey, Giuliano Albanese, Renaud Detry, Luc Van Gool, Danda Paudel

机构 * KU Leuven, Dept. Mechanical Engineering, Research unit Robotics, Automation and Mechatronics(库勒恩大学,机械工程系,机器人、自动化与机电一体化研究单位) KU Leuven, Dept. Electrical Engineering, Research unit Processing Speech and Images(库勒恩大学,电气工程系,语音和图像处理研究单位)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 AR-VLA提出了一种自回归动作专家,通过长时记忆保持上下文,解决快控与慢思的频率不匹配问题,实现高效预训练和模块化集成,提升动作生成的时空一致性。

Comments RSS 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15686 2026-05-12 cs.LG 57%

Beyond Hard Writes and Rigid Preservation: Soft Recursive Least-Squares for Lifelong LLM Editing

超越硬写和刚性保存:用于终身LLM编辑的软递归最小二乘法

Xinyu Wang, Sicheng Lyu, Yu Gu, Jerry Huang, Peng Lu, Yufei Cui, Xiao-Wen Chang

机构 * McGill University(麦吉尔大学) Mila–Quebec AI Institute(蒙特利尔AI研究院) Université de Montréal(蒙特利尔大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出RLSEdit,一种递归最小二乘编辑器,通过在线二次优化和软约束实现长期序列编辑,有效平衡编辑精度与稳定性,实验显示其在多个模型家族上稳定扩展至10000次编辑,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09760 2026-05-12 cs.CL 57%

ConFit v3: Improving Resume-Job Matching with LLM-based Re-Ranking

ConFit v3:通过基于LLM的重排序提升简历-岗位匹配

Xiao Yu, Ruize Xu, Chengyuan Xue, Junyu Chen, Matthew So, Shijun Ma, Bo Liu, Xiangye Liang, Zhou Yu

机构 * Columbia University(哥伦比亚大学) John Hopkins University(约翰霍普金斯大学) Intellipro Group Inc.(Intellipro集团)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出ConFit v3,通过改进重排序算法和数据处理方法,提升简历与岗位匹配的准确性,优于现有最佳系统和大型语言模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09649 2026-05-12 cs.LG 57%

Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction

让每个token计数:通过KV缓存淘汰提升长上下文性能

Ngoc Bui, Hieu Trung Nguyen, Arman Cohan, Rex Ying

机构 * Department of Computer Science Yale University(耶鲁大学计算机科学系) The Chinese University of Hong Kong(香港中文大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种基于全局保留的KV缓存淘汰方法,通过学习每个token的未来效用,减少缓存内存占用并提升长上下文推理性能。

Comments A learnable KV eviction method for large language models

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06763 2026-05-12 cs.LG 57%

Sparse Attention as a Range Searching Problem: Towards an Inference-Efficient Index for KV Cache

稀疏注意力作为范围搜索问题:迈向一种高效的KV缓存索引

Mohsen Dehghankar, Abolfazl Asudeh

机构 * Department of Computer Science(计算机科学系) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出Louver索引,通过将稀疏注意力重新表述为半空间范围搜索问题,解决KV缓存检索中的准确性和效率问题,实验表明其在精度和运行时间上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08817 2026-05-12 cs.AI 57%

How You Begin is How You Reason: Driving Exploration in RLVR via Prefix-Tuned Priors

如何开始就是如何推理:通过前缀微调先验驱动RLVR探索

Yifan Xu, Junren Chen, Yifan Chen

机构 * Hong Kong Baptist University(香港 Baptist 大学) University of Maryland, College Park(马里兰大学 College Park 分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出IMAX框架,通过训练软前缀来重塑基础模型的推理轨迹先验,以解决RLVR中探索不足的问题,提升推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08666 2026-05-12 cs.LG 57%

The Cancellation Hypothesis in Critic-Free RL: From Outcome Rewards to Token Credits

无评论强化学习中的取消假设:从结果奖励到令牌信用

Tianhao Cheng, Zeyu Huang, Zihan Qiu, Yu Cheng, Edoardo Ponti, Yinghui Xu, Ivan Titov, Zenglin Xu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) The University of Edinburgh(爱丁堡大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Academy of AI for Science(上海人工智能科学研究院) Qwen Team, Alibaba Group(阿里集团Qwen团队) University of Amsterdam(阿姆斯特丹大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文从令牌层面研究无评论强化学习,揭示令牌翻转现象,并提出取消假设,解释令牌层面信用分配机制,通过实验验证该假设并提出改进训练的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08580 2026-05-12 cs.MA cs.AI 57%

Slipstream: Trajectory-Grounded Compaction Validation for Long-Horizon Agents

Slipstream: 长时间跨度智能体的轨迹引导压缩验证

Zhuofu Chen, Rui Pan, Yinwei Dai, Ravi Netravali

机构 * Princeton University(普林斯顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 Slipstream通过异步压缩验证提升长时间跨度智能体的任务准确性,减少端到端延迟,适用于代码编写和网页浏览任务。

Comments 9 pages (16 pages counting references, appendix), 6 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08560 2026-05-12 cs.CV cs.AI 57%

ZAYA1-VL-8B Technical Report

ZAYA1-VL-8B 技术报告

Hassan Shapourian, Kasra Hejazi, Olabode M. Sule, Beren Millidge

机构 * Zyphra

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 ZAYA1-VL-8B 是基于内部语言模型 ZAYA1-8B 构建的紧凑多专家视觉语言模型,在多个图像理解、推理和计数基准上超越了 Qwen2.5-VL-3B、PLM-3B 和 MolmoE-1B 等模型。

Comments 20 pages, 7 figures, 3 appendices (with 31 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08527 2026-05-12 cs.DC cs.AI 57%

MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service

MARLaaS:多租户异步强化学习即服务

Timothy Tin Long Yu, Gursimran Singh, Ge Shi, Hanieh Sadri, Yong Zhang, Zhenan Fan

机构 * Huawei Technologies Canada(华为技术加拿大)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 MARLaaS通过轻量LoRA适配器共享基础模型和异步架构解耦训练流程,实现多任务并发强化学习细调,提升加速器利用率4.3倍,训练时间缩短85%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25926 2026-05-12 cs.CR cs.LG 57%

Preventing Prompt Injection with Type-Directed Privilege Separation

通过类型引导的特权分离防止提示注入

Dennis Jacob, Emad Alghamdi, Zhanhao Hu, Basel Alomair, David Wagner

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出一种类型引导的特权分离技术,通过将不可信数据转换为受控的数据类型,有效防止提示注入攻击,同时保持系统的实用性和兼容性。

Comments Revised manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.08383 2026-05-12 cs.CL 57%

Change My View? The Dynamics of Persuasion and Polarization in Online Discourse

改变观点?在线讨论中说服与极化的动态

David Freeborn, Malihe Alikani, Anthony Sicilia

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究通过分析Reddit的ChangeMyView讨论,探讨说服与极化动态,发现让步与共情策略促进观点改变,而直接反驳等策略则抑制观点改变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07568 2026-05-11 cs.CV cs.CL 57%

Tracing the Arrow of Time: Diagnosing Temporal Information Flow in Video-LLMs

追踪时间之箭:诊断视频大语言模型中的时间信息流

Peitao Han, Fei Cheng, Lis K. Pereira, Qianying Liu, Shigeru Kitazawa

机构 * The University of Osaka(大阪大学) Center for Information and Neural Networks(信息与神经网络中心) National Institute of Information and Communications Technology(信息与通信技术国家研究所) Kyoto University(京都大学) NII LLMC(日本信息处理学会LLMC)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文研究视频大语言模型(Video-LLMs)中时间信息流的瓶颈问题,通过分析编码器、投影器和LLM的结构,发现视频中心编码器能有效编码时间信息,但投影器设计影响信息传递,改进后模型在时间推理任务中表现显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00932 2026-05-11 cs.SE cs.AI 57%

Code World Model Preparedness Report

代码世界模型准备性报告

Daniel Song, Peter Ney, Cristina Menghini, Faizan Ahmad, Aidan Boyd, Nathaniel Li, Ziwen Han, Jean-Christophe Testud, Saisuke Okabayashi, Maeve Ryan, Jinpeng Miao, Hamza Kwisaba, Felix Binder, Spencer Whitman, Jim Gust, Esteban Arcaute, Dhaval Kapil, Jacob Kahn, Ayaz Minhas, Tristan Goodman, Lauren Deason, Alexander Vaughan, Shengjia Zhao, Summer Yue

机构 * MSL Preparedness Team(MSL准备团队) AI Security Team(AI安全团队)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 报告评估了Meta的代码世界模型在潜在灾难性风险领域的准备情况,发现其风险与现有AI生态无异,因此作为开源模型发布。

Comments 25 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06403 2026-05-08 cs.CL cs.IR 57%

GATHER: Convergence-Centric Hyper-Entity Retrieval for Zero-Shot Cell-Type Annotation

GATHER:面向零样本细胞类型注释的收敛性超实体检索

Zhonghui Zhang, Feng Jiang, Shaowei Qin, Jiahao Zhao, Min Yang

机构 * Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术大学人工智能研究院) Software College, Northeastern University(东北大学软件学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 GATHER通过全局多源图遍历识别拓扑收敛点,以高信息超实体捕捉实体协同,无需LLM参与检索,提升零样本细胞类型注释效率。

Comments Accepted to SIGIR 2026. 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06347 2026-05-08 cs.HC cs.AI 57%

Human-AI Co-Evolution and Epistemic Collapse: A Dynamical Systems Perspective

人类与人工智能的共演与知识崩溃:一种动态系统视角

Xuening Wu, Yanlan Kang, Qianya Xu, Kexuan Xie, Jiaqi Mi, Honggang Wang, Yubin Liu, Zeping Chen

机构 * Fudan University(复旦大学) Tongji University(同济大学) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) University of California San Diego(加州大学圣地亚哥分校) Nanjing University of Posts and Telecommunications(南京邮电大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文从动态系统视角探讨人类与语言模型的共演及知识崩溃问题,提出人类与模型形成反馈闭环的耦合系统,通过三变量模型揭示共进化增强、脆弱均衡和退化收敛三种动态模式。

Comments 5 pages, 3 figures, ICML EIML Workshop submitted

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06342 2026-05-08 cs.CL 57%

Don't Lose Focus: Activation Steering via Key-Orthogonal Projections

不要失去焦点:通过键正交投影进行激活引导

Haoyan Luo, Mateo Espinosa Zarlenga, Mateja Jamnik

机构 * University of Cambridge(剑桥大学) University of Oxford(牛津大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出SKOP方法,通过约束有害的注意力重路由,减少激活引导对推理和检索性能的负面影响,实现最佳的引导-实用性平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06058 2026-05-08 cs.LG cs.CV 57%

Towards Self-Explainable Document Visual Question Answering with Chain-of-Explanation Predictions

迈向具有解释链预测的自解释文档视觉问答

Kjetil Indrehus, Adrian Duric, Changkyu Choi, Ali Ramezani-Kebrya

机构 * Department of Informatics, University of Oslo(奥斯陆大学信息学院) Integreat – Norwegian Centre for Knowledge-driven Machine Learning(挪威知识驱动机器学习中心) TRUST – The Norwegian Centre for Trustworthy AI(挪威可信人工智能中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出CoExVQA框架,通过解释链设计实现文档视觉问答的自解释,通过证据识别、答案定位和基于证据解码三步流程提升可解释性,实验显示在PFL-DocVQA上取得SotA性能,ANLS提升12%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11016 2026-05-08 cs.CV cs.AI 57%

SoccerMaster: A Vision Foundation Model for Soccer Understanding

SoccerMaster: 一种用于足球理解的视觉基础模型

Haolin Yang, Jiayuan Rao, Haoning Wu, Weidi Xie

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Shanghai Innovation Institute(上海创新研究院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SoccerMaster,一种统一的足球视觉理解模型,通过多任务预训练统一处理从细粒度感知到高层语义推理的多种任务,实验表明其在多种下游任务中表现优异。

Comments Accepted by CVPR 2026 (Oral); Project Page: https://haolinyang-hlyang.github.io/SoccerMaster

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12635 2026-05-08 cs.AI 57%

Memory as Action: Autonomous Context Curation for Long-Horizon Agentic Tasks

记忆作为行动:面向长周期智能任务的自主上下文编纂

Yuxiang Zhang, Jiangming Shu, Ye Ma, Xueyuan Lin, Shangxi Wu, Jitao Sang

机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) Hithink Research(慧思科技) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Huawei Noah’s Ark Lab(华为诺亚实验室) Peng Cheng Lab(鹏城实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出MemAct框架,将工作记忆管理作为可学习的策略动作,通过端到端强化学习优化信息保留与任务表现,实验显示其在保持准确性的同时显著减少上下文长度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05410 2026-05-08 cs.AI cs.HC physics.ed-ph 57%

LaTA: A Drop-in, FERPA-Compliant Local-LLM Autograder for Upper-Division STEM Coursework

LaTA:一个符合FERPA规定的本地LLM自动评分器,用于大二STEM课程作业

Jesse A. Rodríguez

机构 * School of Mechanical, Industrial, and Manufacturing Engineering(机械、工业与制造工程学院)

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.AI

AI总结 LaTA是一种本地LLM自动评分器,可有效减轻大二STEM课程的评分负担,通过本地运行和LaTeX流程,实现零成本评分,提升学生自信心并提高考试成绩。

Comments Submitted to Computers & Education

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05271 2026-05-08 cs.CR cs.AI 57%

Shattering the Echo Chamber: Hidden Safeguards in Manuscripts Against the AI Takeover of Peer Review

打破回声室:对抗AI接管同行评审的隐藏保障

Oubo Ma, Ruixiao Lin, Jiahao Chen, Yuan Su, Yong Yang, Shouling Ji

机构 * Zhejiang University(浙江大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出IntraGuard框架,通过在PDF结构中嵌入异构防御文本对象,有效抵御AI生成的同行评审,实现84%的防御成功率,且不影响人类评审。

Comments 22 pages, 14 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10241 2026-05-08 cs.CL cs.IR 57%

ImCoref-CeS: An Improved Lightweight Pipeline for Coreference Resolution with LLM-based Checker-Splitter Refinement

ImCoref-CeS: 一种改进的轻量级管道用于基于LLM的检查-分割细化的指代消解

Kangyang Luo, Yuzhuo Bai, Shuzheng Si, Cheng Gao, Zhitong Wang, Yingli Shen, Wenhao Li, Zhu Liu, Yufeng Han, Jiayi Wu, Cunliang Kong, Maosong Sun

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Institute for AI, Tsinghua University(清华大学人工智能研究院) East China Normal University(华东师范大学) Jiangsu Collaborative Innovation Center for Language Ability(江苏省语言能力协同创新中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出ImCoref-CeS框架,结合增强的监督模型与LLM推理,通过改进的指代消解方法和LLM多角色检查-分割代理提升性能。

Comments Accepted by ACL2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏