arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 19037 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19037 篇

2410.23884 2025-06-17 cs.LG cs.CL 79%

Failure Modes of LLMs for Causal Reasoning on Narratives

Khurram Yamin, Shantanu Gupta, Gaurav R. Ghosal, Zachary C. Lipton, Bryan Wilder

机构 * Carnegie Mellon(卡内基梅隆大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICML 2025 Workshop on Scaling up Intervention Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12301 2025-06-17 cs.LG cs.AI 79%

Unveiling Confirmation Bias in Chain-of-Thought Reasoning

Yue Wan, Xiaowei Jia, Xiang Lorraine Li

机构 * University of Pittsburgh(匹兹堡大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Journal ref ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10161 2025-06-13 cs.CL cs.AI 79%

Can LLMs Generate Good Stories? Insights and Challenges from a Narrative Planning Perspective

Yi Wang, Max Kreminski

机构 * Autodesk Research(Autodesk研究院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments In 2025 IEEE Conference on Games (CoG)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09985 2025-06-12 cs.AI cs.CV cs.LG cs.RO 79%

V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning

Mido Assran, Adrien Bardes, David Fan, Quentin Garrido, Russell Howes, Mojtaba, Komeili, Matthew Muckley, Ammar Rizvi, Claire Roberts, Koustuv Sinha, Artem Zholus, Sergio Arnaud, Abha Gejji, Ada Martin, Francois Robert Hogan, Daniel Dugas, Piotr Bojanowski, Vasil Khalidov, Patrick Labatut, Francisco Massa, Marc Szafraniec, Kapil Krishnakumar, Yong Li, Xiaodong Ma, Sarath Chandar, Franziska Meier, Yann LeCun, Michael Rabbat, Nicolas Ballas

机构 * FAIR at Meta Mila -- Quebec AI Institute

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

Comments 48 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07564 2025-06-12 cs.AI cs.CL 79%

SAFEFLOW: A Principled Protocol for Trustworthy and Transactional Autonomous Agent Systems

Peiran Li, Xinkai Zou, Zhuohang Wu, Ruifeng Li, Shuo Xing, Hanwen Zheng, Zhikai Hu, Yuping Wang, Haoxi Li, Qin Yuan, Yingmo Zhang, Zhengzhong Tu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Former versions either contain unrelated content or cannot be properly converted to PDF

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16033 2025-06-12 cs.CL cs.AI 79%

Multimodal Inconsistency Reasoning (MMIR): A New Benchmark for Multimodal Reasoning Models

Qianqi Yan, Yue Fan, Hongquan Li, Shan Jiang, Yang Zhao, Xinze Guan, Ching-Chen Kuo, Xin Eric Wang

机构 * University of California, Santa Cruz(加州大学圣克ruz分校) eBay(eBay公司)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08243 2025-06-11 cs.LG cs.AI 79%

Temporalizing Confidence: Evaluation of Chain-of-Thought Reasoning with Signal Temporal Logic

Zhenjiang Mao, Artem Bisliouk, Rohith Reddy Nama, Ivan Ruchkin

机构 * University of Florida(佛罗里达大学) University of Mannheim(曼海姆大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07232 2025-06-10 cs.MA cs.AI cs.LG 79%

Learn as Individuals, Evolve as a Team: Multi-agent LLMs Adaptation in Embodied Environments

Xinran Li, Chenjia Bai, Zijian Li, Jiakun Zheng, Ting Xiao, Jun Zhang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02878 2025-06-10 cs.CL cs.AI 79%

CoT is Not True Reasoning, It Is Just a Tight Constraint to Imitate: A Theory Perspective

Jintian Shao, Yiming Cheng

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Last page bad picture, lacking some sufficient experiments

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11586 2025-06-10 cs.AI cs.CL 79%

Broaden your SCOPE! Efficient Multi-turn Conversation Planning for LLMs with Semantic Space

Zhiliang Chen, Xinyuan Niu, Chuan-Sheng Foo, Bryan Kian Hsiang Low

机构 * Department of Computer Science, National University of Singapore(新加坡国立大学计算机科学系) Institute for Infocomm Research (I2R), A*STAR, Singapore(新加坡A*STAR信息与通信研究所) Centre for Frontier AI Research (CFAR), A*STAR, Singapore(新加坡A*STAR前沿人工智能研究中心)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ICLR 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06009 2025-06-09 cs.CL cs.AI 79%

Unlocking Recursive Thinking of LLMs: Alignment via Refinement

Haoke Zhang, Xiaobo Liang, Cunxiang Wang, Juntao Li, Min Zhang

机构 * Soochow University(苏州大学) Zhipu AI(智谱AI) Tsinghua University(清华大学) Key Laboratory of Data Intelligence and Advanced Computing, Soochow University(苏州大学数据智能与先进计算重点实验室)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments Accepted to the Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00555 2025-06-06 cs.CR cs.AI cs.LG 79%

Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable

Tiansheng Huang, Sihao Hu, Fatih Ilhan, Selim Furkan Tekin, Zachary Yahn, Yichang Xu, Ling Liu

机构 * School of Computer Science(计算机科学学院) Georgia Institute of Technology(佐治亚理工学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15098 2025-06-06 cs.LG cs.AI 79%

Multi-granularity Knowledge Transfer for Continual Reinforcement Learning

Chaofan Pan, Lingfei Ren, Yihui Feng, Linbo Xiong, Wei Wei, Yonghao Li, Xin Yang

机构 * Southwestern University of Finance and Economics(西南财经大学) Shanxi University(山西大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments the 34th International Joint Conference on Artificial Intelligence (IJCAI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01679 2025-06-05 cs.LG cs.CL 79%

VinePPO: Refining Credit Assignment in RL Training of LLMs

Amirhossein Kazemnejad, Milad Aghajohari, Eva Portelance, Alessandro Sordoni, Siva Reddy, Aaron Courville, Nicolas Le Roux

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at ICML 2025; 12 pages and 22 pages Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13360 2025-06-04 cs.CV cs.AI cs.LG 79%

Mitigating Visual Forgetting via Take-along Visual Conditioning for Multi-modal Long CoT Reasoning

Hai-Long Sun, Zhun Sun, Houwen Peng, Han-Jia Ye

机构 * School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) Tencent(腾讯) Center for Language AI Research, Tohoku University(东北大学语言人工智能研究中心) RIKEN Center for Advanced Intelligence Project(日本理化学研究所先进人工智能项目中心)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments Accepted to ACL 2025. The project page is available at https://sun-hailong.github.io/projects/TVC

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06705 2025-06-04 cs.CL cs.AI 79%

LLMs can Find Mathematical Reasoning Mistakes by Pedagogical Chain-of-Thought

Zhuoxuan Jiang, Haoyuan Peng, Shanshan Feng, Fan Li, Dongsheng Li

机构 * Shanghai Business School(上海商学院) Learnable.AI Inc.(Learnable.AI公司) Centre for Frontier AI Research, A*STAR(前沿人工智能研究中心,A*STAR) Institute of High-Performance Computing, A*STAR(高性能计算研究所,A*STAR) The Hong Kong Polytechnic University(香港理工大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01698 2025-06-03 cs.CL cs.AI 79%

When LLMs Team Up: The Emergence of Collaborative Affective Computing

Wenna Lai, Haoran Xie, Guandong Xu, Qing Li, S. Joe Qin

机构 * Department of Computing, Hong Kong Polytechnic University(香港理工大学计算机系) School of Data Science, Lingnan University(岭南大学数据科学学院) School of Computer Science and the Data Science Institute, University of Technology Sydney(悉尼大学计算机科学学院和数据科学研究所) Education University of Hong Kong(香港教育大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 7 figures, and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01332 2025-06-03 cs.AI cs.CL cs.MA 79%

An Empirical Study of Group Conformity in Multi-Agent Systems

Min Choi, Keonwoo Kim, Sungwon Chae, Sangyeob Baek

机构 * Kim & Chang AI&IT System Center(金 & Chang AI&IT 系统中心)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref ACL 2025 (findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14870 2025-06-03 cs.AI cs.CL 79%

Acting Less is Reasoning More! Teaching Model to Act Efficiently

Hongru Wang, Cheng Qian, Wanjun Zhong, Xiusi Chen, Jiahao Qiu, Shijue Huang, Bowen Jin, Mengdi Wang, Kam-Fai Wong, Heng Ji

机构 * The Chinese University of Hong Kong(香港中文大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴娜-香槟分校) Princeton University(普林斯顿大学) Sun Yat-sen University(中山大学) Hong Kong University of Science and Technology(香港科学理工大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13344 2025-05-30 cs.LG cs.CL q-bio.BM 79%

K-Paths: Reasoning over Graph Paths for Drug Repurposing and Drug Interaction Prediction

Tassallah Abdullahi, Ioanna Gemou, Nihal V. Nayak, Ghulam Murtaza, Stephen H. Bach, Carsten Eickhoff, Ritambhara Singh

机构 * Brown University(布朗大学) University of Tübingen(图宾根大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Journal ref Proceedings of the 31st ACM SIGKDD Conference on Knowledge Discovery and Data Mining V.2 (KDD '25), August 3--7, 2025, Toronto, ON, Canada

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21493 2025-05-28 cs.LG cs.CL 79%

Reinforcing General Reasoning without Verifiers

Xiangxin Zhou, Zichen Liu, Anya Sims, Haonan Wang, Tianyu Pang, Chongxuan Li, Liang Wang, Min Lin, Chao Du

机构 * Sea AI Lab, Singapore(新加坡海智实验室) University of Chinese Academy of Sciences(中国科学院大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) National University of Singapore(新加坡国立大学) University of Oxford(牛津大学) Renmin University of China(中国人民大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03205 2025-05-28 cs.CL cs.AI 79%

MA-LoT: Model-Collaboration Lean-based Long Chain-of-Thought Reasoning enhances Formal Theorem Proving

Ruida Wang, Rui Pan, Yuxin Li, Jipeng Zhang, Yizhen Jia, Shizhe Diao, Renjie Pi, Junjie Hu, Tong Zhang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06638 2025-05-28 cs.CL cs.AI 79%

Subtle Errors in Reasoning: Preference Learning via Error-injected Self-editing

Kaishuai Xu, Tiezheng Yu, Wenjun Hou, Yi Cheng, Chak Tou Leong, Liangyou Li, Xin Jiang, Lifeng Shang, Qun Liu, Wenjie Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments accepted as ACL 2025 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05673 2025-05-28 cs.AI cs.CL 79%

Flow of Reasoning: Training LLMs for Divergent Reasoning with Minimal Examples

Fangxu Yu, Lai Jiang, Haoqiang Kang, Shibo Hao, Lianhui Qin

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20245 2025-05-27 cs.CL cs.AI 79%

KnowTrace: Bootstrapping Iterative Retrieval-Augmented Generation with Structured Knowledge Tracing

Rui Li, Quanyu Dai, Zeyu Zhang, Xu Chen, Zhenhua Dong, Ji-Rong Wen

机构 * Gaoling School of Artificial Intelligence(人工智能学院) Renmin University of China(中国人民大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20047 2025-05-27 cs.CL cs.AI cs.LO cs.SE 79%

Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks

Debargha Ganguly, Vikash Singh, Sreehari Sankar, Biyao Zhang, Xuecen Zhang, Srinivasan Iyengar, Xiaotian Han, Amit Sharma, Shivkumar Kalyanaraman, Vipin Chaudhary

机构 * Case Western Reserve University(凯斯西储大学) Microsoft Corporation(微软公司) Microsoft Research(微软研究院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12568 2025-05-27 cs.CL cs.AI 79%

A Cognitive Writing Perspective for Constrained Long-Form Text Generation

Kaiyang Wan, Honglin Mu, Rui Hao, Haoran Luo, Tianle Gu, Xiuying Chen

机构 * MBZUAI University of Chinese Academy of Sciences(中国科学院大学) Nanyang Technological University(南洋理工大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14810 2025-05-27 cs.CL cs.AI 79%

Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models

Tingchen Fu, Jiawei Gu, Yafu Li, Xiaoye Qu, Yu Cheng

机构 * Renmin University of China(中国人民大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02167 2025-05-27 cs.LG cs.CL 79%

Training Nonlinear Transformers for Chain-of-Thought Inference: A Theoretical Generalization Analysis

Hongkang Li, Songtao Lu, Pin-Yu Chen, Xiaodong Cui, Meng Wang

机构 * Rensselaer Polytechnic Institute(罗切斯特理工学院) The Chinese University of Hong Kong(香港中文大学) IBM Research(IBM研究院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18283 2025-05-27 cs.CL cs.AI cs.MA 79%

TAGS: A Test-Time Generalist-Specialist Framework with Retrieval-Augmented Reasoning and Verification

Jianghao Wu, Feilong Tang, Yulong Li, Ming Hu, Haochen Xue, Shoaib Jameel, Yutong Xie, Imran Razzak

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫莫德·本·扎耶德人工智能大学) Monash University(墨尔本大学) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Southampton(南安普顿大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 16 pages including references, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏