arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 19037 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19037 篇

2511.18743 2025-11-25 cs.CL cs.AI 79%

RhinoInsight: Improving Deep Research through Control Mechanisms for Model Behavior and Context

RhinoInsight: 通过模型行为和上下文的控制机制提升深度研究

Yu Lei, Shuzheng Si, Wei Wang, Yifei Wu, Gang Chen, Fanchao Qi, Maosong Sun

机构 * DeepLang AI Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Beijing Jiaotong University(北京交通大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 RhinoInsight通过引入可验证检查表和证据审计两种控制机制,提升深度研究任务的鲁棒性和可追溯性,同时保持在深度搜索任务中的竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14299 2025-11-25 cs.AI cs.CL cs.MA 79%

DataSage: Multi-agent Collaboration for Insight Discovery with External Knowledge Retrieval, Multi-role Debating, and Multi-path Reasoning

DataSage: 基于外部知识检索、多角色辩论和多路径推理的多智能体协作以实现洞察发现

Xiaochuan Liu, Yuanfeng Song, Xiaoming Yin, Xing Chen

机构 * ByteDance, China(字节跳动)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 DataSage通过多智能体协作、外部知识检索和多路径推理,提升数据洞察发现的准确性和深度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16353 2025-11-25 cs.CL cs.AI 79%

Lessons from Studying Two-Hop Latent Reasoning

从双跳潜在推理研究中获得的启示

Mikita Balesni, Tomek Korbak, Owain Evans

机构 * Apollo Research(Apollo研究机构) UK AI Security Institute(英国人工智能安全研究所) UC Berkeley(加州大学伯克利分校) TruthfulAI

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究通过双跳问答任务揭示LLM潜在推理能力,发现模型在合成事实组合上表现不足,但能处理混合事实场景,强调避免误判推理能力的必要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16016 2025-11-21 cs.LG cs.AI 79%

CARE: Turning LLMs Into Causal Reasoning Expert

CARE: 将大语言模型转化为因果推理专家

Juncheng Dong, Yiling Liu, Ahmed Aloui, Vahid Tarokh, David Carlson

机构 * Duke University(杜克大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

AI总结 CARE通过监督微调提升LLMs的因果推理能力,使其在因果发现任务中超越传统算法和大参数模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16983 2025-11-20 cs.CL cs.AI 79%

ReFactX: Scalable Reasoning with Reliable Facts via Constrained Generation

Riccardo Pozzi, Matteo Palmonari, Andrea Coletta, Luigi Bellomarini, Jens Lehmann, Sahar Vahdati

机构 * University of Milano-Bicocca(米兰-比科卡大学) Banca d'Italia(意大利银行) Institute for Applied Informatics (InfAI)(应用信息研究所) TIB Leibniz Information Centre for Science and Technology(科学与技术信息中心) ScaDS.AI Dresden/Leipzig(ScaDS.AI 德累斯顿/莱比锡分校) Technische Universität Dresden(德累斯顿技术大学) Data Science Institute(数据科学研究所) Leibniz University Hannover(汉诺威莱布尼茨大学) Amazon(亚马逊)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 19 pages, 6 figures, accepted at ISWC

Journal ref The Semantic Web - ISWC 2025. ISWC 2025. Lecture Notes in Computer Science, vol 16140. Springer, Cham

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18070 2025-11-20 cs.CL cs.AI 79%

PropRAG: Guiding Retrieval with Beam Search over Proposition Paths

Jingjin Wang, Jiawei Han

机构 * Siebel School of Computing and Data Science, University of Illinois Urbana-Champaign(塞比尔计算与数据科学学院,伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 (Main Conference). Camera-ready version. Code and data: https://github.com/ReLink-Inc/PropRAG

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 6224-6239 November 4-9, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13948 2025-11-19 cs.CV cs.CL cs.LG 79%

EchoAgent: Guideline-Centric Reasoning Agent for Echocardiography Measurement and Interpretation

Matin Daghyani, Lyuyang Wang, Nima Hashemi, Bassant Medhat, Baraa Abdelsamad, Eros Rojas Velez, XiaoXiao Li, Michael Y. C. Tsang, Christina Luong, Teresa S. M. Tsang, Purang Abolmaesumi

机构 * University of British Columbia(不列颠哥伦比亚大学) Vancouver General Hospital(温哥华总医院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 12 pages, Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25101 2025-11-19 cs.AI cs.CL 79%

KnowCoder-A1: Incentivizing Agentic Reasoning Capability with Outcome Supervision for KBQA

Zhuo Chen, Fei Wang, Zixuan Li, Zhao Zhang, Weiwei Ding, Chuanguang Yang, Yongjun Xu, Xiaolong Jin, Jiafeng Guo

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) State Key Laboratory of AI Safety(人工智能安全国家重点实验室) School of Computer Science, University of Chinese Academy of Sciences(中国科学院大学计算机科学学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14507 2025-11-18 cs.CL cs.AI 79%

A is for Absorption: Studying Feature Splitting and Absorption in Sparse Autoencoders

David Chanin, James Wilken-Smith, Tomáš Dulka, Hardik Bhatnagar, Satvik Golechha, Joseph Bloom

机构 * LASR Labs(LASR实验室) University College London(伦敦大学学院) Tübingen AI Center, University of Tübingen(图宾根大学人工智能中心) MATS Decode Research(Decode研究)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at NeurIPS 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11693 2025-11-18 cs.AI cs.CR cs.CV cs.LG 79%

Value-Aligned Prompt Moderation via Zero-Shot Agentic Rewriting for Safe Image Generation

Xin Zhao, Xiaojun Chen, Bingshan Liu, Zeyao Liu, Zhendong Zhao, Xiaoyan Gu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16657 2025-11-17 cs.CV cs.AI cs.CL 79%

DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation

Zun Wang, Jialu Li, Han Lin, Jaehong Yoon, Mohit Bansal

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments AAAI 2026, Project website: https://zunwang1.github.io/DreamRunner

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09005 2025-11-13 cs.AI cs.CL cs.MA 79%

AI Founding Fathers: A Case Study of GIS Search in Multi-Agent Pipelines

Alvin Chauhan

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 3 figures. Code and data available at https://github.com/alvco/Founding_Fathers_AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08596 2025-11-13 cs.CL cs.AI cs.CY 79%

What About the Scene with the Hitler Reference? HAUNT: A Framework to Probe LLMs' Self-consistency Via Adversarial Nudge

Arka Dutta, Sujan Dutta, Rijul Magu, Soumyajit Datta, Munmun De Choudhury, Ashiqur R. KhudaBukhsh

机构 * Rochester Institute of Technology(罗切斯特技术学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07166 2025-11-11 cs.CL cs.AI cs.CE 79%

AdaRec: Adaptive Recommendation with LLMs via Narrative Profiling and Dual-Channel Reasoning

Meiyun Wang, Charin Polpanumas

机构 * The University of Tokyo(东京大学) Amazon.com, Inc.(亚马逊公司)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06575 2025-11-11 cs.RO cs.AI cs.LG 79%

CoFineLLM: Conformal Finetuning of LLMs for Language-Instructed Robot Planning

Jun Wang, Yevgeniy Vorobeychik, Yiannis Kantaros

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24409 2025-11-11 cs.CL cs.AI 79%

When Language Shapes Thought: Cross-Lingual Transfer of Factual Knowledge in Question Answering

Eojin Kang, Juae Kim

机构 * Hankuk University of Foreign Studies(韩国外国语大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted at CIKM2025 (Expanded version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12477 2025-11-11 cs.AI cs.CL cs.HC 79%

Towards Conversational AI for Human-Machine Collaborative MLOps

George Fatouros, Georgios Makridis, George Kousiouris, John Soldatos, Anargyros Tsadimas, Dimosthenis Kyriazis

机构 * Innov-Acts Ltd(Innov-Acts公司) Dept. of Digital Systems(数字系统系) University of Piraeus(比雷埃克斯大学) Dept. of Informatics and Telematics(信息与电信学系) Harokopio University(哈罗科比奥大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 5 figures

Journal ref 2025 21st International Conference on Distributed Computing in Smart Systems and the Internet of Things (DCOSS-IoT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12767 2025-11-11 cs.CL cs.AI 79%

R2-KG: General-Purpose Dual-Agent Framework for Reliable Reasoning on Knowledge Graphs

Sumin Jo, Junseong Choi, Jiho Kim, Edward Choi

机构 * KAIST(韩国科学技术院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to IJCNLP-AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18574 2025-11-07 cs.PL cs.AI cs.AR cs.LG 79%

Autocomp: A Powerful and Portable Code Optimizer for Tensor Accelerators

Charles Hong, Sahil Bhatia, Alvin Cheung, Yakun Sophia Shao

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages + appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03159 2025-11-06 cs.LG cs.AI 79%

CoTox: Chain-of-Thought-Based Molecular Toxicity Reasoning and Prediction

Jueon Park, Yein Park, Minju Song, Soyon Park, Donghyeon Lee, Seungheun Baek, Jaewoo Kang

机构 * Department of Computer Science and Engineering(计算机科学与工程系) AIGEN Sciences(AIGEN公司)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to IEEE BIBM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03206 2025-11-06 cs.CV cs.AI cs.LG 79%

QG-CoC: Question-Guided Chain-of-Captions for Large Multimodal Models

Kuei-Chun Kao, Hsu Tzu-Yin, Yunqi Hong, Ruochen Wang, Cho-Jui Hsieh

机构 * Department of Computer Science, University of California, Los Angeles(计算机科学系,加州大学洛杉矶分校)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments 16 pages

Journal ref EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00960 2025-11-05 cs.CL cs.AI 79%

The Riddle of Reflection: Evaluating Reasoning and Self-Awareness in Multilingual LLMs using Indian Riddles

Abhinav P M, Ojasva Saxena, Oswald C, Parameswari Krishnamurthy

机构 * International Institute of Information Technology, Hyderabad(国际信息科技研究所,海得拉巴) National Institute of Technology, Tiruchirappalli(国家理工学院,特里奇里帕利)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01203 2025-11-04 cs.LG cs.CL 79%

FEval-TTC: Fair Evaluation Protocol for Test-Time Compute

Pavel Rumiantsev, Soumyasundar Pal, Yingxue Zhang, Mark Coates

机构 * McGill University(麦吉尔大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25776 2025-10-31 cs.CL cs.LG 79%

StreetMath: Study of LLMs' Approximation Behaviors

Chiung-Yi Tseng, Somshubhra Roy, Maisha Thasin, Danyang Zhang, Blessing Effiong

机构 * LuxMuse AI(LuxMuse人工智能公司) Department of Electrical and Computer Engineering, North Carolina State University(北卡罗来纳州立大学电气与计算机工程系) Department of Mathematics, University of Waterloo(滑铁卢大学数学系) Vokram Group(Vokram集团) Department of Computer Science, Saint Louis University(圣路易斯大学计算机科学系)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00814 2025-10-30 cs.CL cs.AI cs.CY 79%

Many LLMs Are More Utilitarian Than One

Anita Keshmirian, Razan Baltaji, Babak Hemmatian, Hadi Asghari, Lav R. Varshney

机构 * Forward College(前进学院) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Nebraska, Lincoln(内布拉斯加大学林肯分校) Technische Universität Berlin(柏林技术大学) Humboldt Institute for Internet and Society(洪堡互联网与社会研究所) Stony Brook University(石溪大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to the Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07382 2025-10-30 cs.AI cs.LG 79%

Pentest-R1: Towards Autonomous Penetration Testing Reasoning Optimized via Two-Stage Reinforcement Learning

He Kong, Die Hu, Jingguo Ge, Liangxiong Li, Hui Li, Tong Li

机构 * State Key Laboratory of Cyberspace Security Defense, Institute of Information Engineering, Chinese Academy of Sciences(中国科学院网络空间安全防御重点实验室,信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络与安全学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21727 2025-10-29 cs.IR cs.AI cs.LG 79%

Your Dense Retriever is Secretly an Expeditious Reasoner

Yichi Zhang, Jun Bai, Zhixin Cai, Shuhan Qin, Zhuofan Chen, Jinghua Guan, Wenge Rong

机构 * School of Computer Science and Engineering, Beihang University, China(北京航空航天大学计算机科学与工程学院) Beijing Institute for General Artificial Intelligence, China(北京通用人工智能研究院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 16 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21715 2025-10-28 cs.HC cs.AI cs.CL eess.AS 79%

Beyond IVR Touch-Tones: Customer Intent Routing using LLMs

Sergio Rojas-Galeano

机构 * Facultad de Ingeniería Universidad Distrital Francisco José de Caldas(工程学院乌尔比诺大学弗朗西斯科·乔斯·德·卡拉斯多分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication in the Proceedings of the Workshop on Engineering Applications 2025 (WEA 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06485 2025-10-27 cs.CV cs.AI cs.CL 79%

Video-RTS: Rethinking Reinforcement Learning and Test-Time Scaling for Efficient and Enhanced Video Reasoning

Ziyang Wang, Jaehong Yoon, Shoubin Yu, Md Mohaiminul Islam, Gedas Bertasius, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Nanyang Technological University(南洋理工大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025. The first two authors contributed equally. Project page: https://sites.google.com/cs.unc.edu/videorts2025/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23794 2025-10-27 cs.CL cs.AI 79%

R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning

Yuan Li, Qi Luo, Xiaonan Li, Bufan Li, Qinyuan Cheng, Bo Wang, Yining Zheng, Yuxin Wang, Zhangyue Yin, Xipeng Qiu

机构 * School of Computer Science, Fudan University(复旦大学计算机学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏