arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5891 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5891 篇

2506.13178 2025-06-17 cs.CL 57%

Enhancing Large Language Models with Reliable Knowledge Graphs

Qinggang Zhang

机构 * Department of Computing(计算系)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09983 2025-06-17 cs.CL 57%

Step-by-step Instructions and a Simple Tabular Output Format Improve the Dependency Parsing Accuracy of LLMs

Hiroshi Matsuda, Chunpeng Ma, Masayuki Asahara

机构 * Megagon Labs(梅加贡实验室) Recruit Co., Ltd.(招聘公司) National Institute for Japanese Language and Linguistics(日本语言学研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 9 pages, 2 figures, accepted to SyntaxFest 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14057 2025-06-17 cs.CL 57%

Co-occurrence is not Factual Association in Language Models

Xiao Zhang, Miao Li, Ji Wu

机构 * Department of Electronics Engineering(电子工程系) Tsinghua University(清华大学) Department of Electronics Engineering, College of AI(人工智能学院电子工程系) Beijing National Research Center for Information Science and Technology(北京信息科学国家研究中心) Center for Big Data and Clinical Research, Institute for Precision Medicine(精准医学研究院大数据与临床研究中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04223 2025-06-17 cs.CV cs.AI 57%

VideoQA in the Era of LLMs: An Empirical Study

Junbin Xiao, Nanxin Huang, Hangyu Qin, Dongyang Li, Yicong Li, Fengbin Zhu, Zhulin Tao, Jianxing Yu, Liang Lin, Tat-Seng Chua, Angela Yao

机构 * National University of Singapore(新加坡国立大学) Communication University of China(中国传媒大学) Sun Yat-Sen University(中山大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments IJCV'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07087 2025-06-17 cs.AI 57%

Applying Cognitive Design Patterns to General LLM Agents

Robert E. Wray, James R. Kirk, John E. Laird

机构 * Center for Integrated Cognition, IQMRI(整合认知中心,IQMRI)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments 10 pages + references, 2 figures, 3 tables. Accepted for oral presentation at AGI25

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11737 2025-06-16 cs.CV cs.CL cs.MM 57%

Quizzard@INOVA Challenge 2025 -- Track A: Plug-and-Play Technique in Interleaved Multi-Image Model

Dinh Viet Cuong, Hoang-Bao Le, An Pham Ngoc Nguyen, Liting Zhou, Cathal Gurrin

机构 * School of Computing, Dublin City University(都柏林城市大学计算机学院) ADAPT Centre(ADAPT中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11068 2025-06-16 cs.CL 57%

Deontological Keyword Bias: The Impact of Modal Expressions on Normative Judgments of Language Models

Bumjin Park, Jinsil Lee, Jaesik Choi

机构 * KAIST AI(韩国科学技术院人工智能研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 20 pages including references and appendix; To appear in ACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13615 2025-06-16 cs.CL 57%

Long-context Non-factoid Question Answering in Indic Languages

Ritwik Mishra, Rajiv Ratn Shah, Ponnurangam Kumaraguru

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Short version of this manuscript accepted at https://bda2025.iiitb.net/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10910 2025-06-13 cs.CL 57%

Magistral

Mistral-AI, :, Abhinav Rastogi, Albert Q. Jiang, Andy Lo, Gabrielle Berrada, Guillaume Lample, Jason Rute, Joep Barmentlo, Karmesh Yadav, Kartik Khandelwal, Khyathi Raghavi Chandu, Léonard Blier, Lucile Saulnier, Matthieu Dinot, Maxime Darrin, Neha Gupta, Roman Soletskyi, Sagar Vaze, Teven Le Scao, Yihan Wang, Adam Yang, Alexander H. Liu, Alexandre Sablayrolles, Amélie Héliou, Amélie Martin, Andy Ehrenberg, Anmol Agarwal, Antoine Roux, Arthur Darcet, Arthur Mensch, Baptiste Bout, Baptiste Rozière, Baudouin De Monicault, Chris Bamford, Christian Wallenwein, Christophe Renaudin, Clémence Lanfranchi, Darius Dabert, Devon Mizelle, Diego de las Casas, Elliot Chane-Sane, Emilien Fugier, Emma Bou Hanna, Gauthier Delerce, Gauthier Guinet, Georgii Novikov, Guillaume Martin, Himanshu Jaju, Jan Ludziejewski, Jean-Hadrien Chabran, Jean-Malo Delignon, Joachim Studnia, Jonas Amar, Josselin Somerville Roberts, Julien Denize, Karan Saxena, Kush Jain, Lingxiao Zhao, Louis Martin, Luyu Gao, Lélio Renard Lavaud, Marie Pellat, Mathilde Guillaumin, Mathis Felardos, Maximilian Augustin, Mickaël Seznec, Nikhil Raghuraman, Olivier Duchenne, Patricia Wang, Patrick von Platen, Patryk Saffer, Paul Jacob, Paul Wambergue, Paula Kurylowicz, Pavankumar Reddy Muddireddy, Philomène Chagniot, Pierre Stock, Pravesh Agrawal, Romain Sauvestre, Rémi Delacourt, Sanchit Gandhi, Sandeep Subramanian, Shashwat Dalal, Siddharth Gandhi, Soham Ghosh, Srijan Mishra, Sumukh Aithal, Szymon Antoniak, Thibault Schueller, Thibaut Lavril, Thomas Robert, Thomas Wang, Timothée Lacroix, Valeriia Nemychnikova, Victor Paltz, Virgile Richard, Wen-Ding Li, William Marshall, Xuanyu Zhang, Yunhao Tang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02686 2025-06-13 cs.CL 57%

Sailing by the Stars: A Survey on Reward Models and Learning Strategies for Learning from Rewards

Xiaobao Wu

机构 * Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 36 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07807 2025-06-13 cs.AI 57%

A Proposal to Extend the Common Model of Cognition with Metacognition

John Laird, Christian Lebiere, Paul Rosenbloom, Andrea Stocco

机构 * IQMRI(IQMRI研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16401 2025-06-13 cs.LG 57%

Divide-Fuse-Conquer: Eliciting "Aha Moments" in Multi-Scenario Games

Xiaoqing Zhang, Huabin Zheng, Ang Lv, Yuhan Liu, Zirui Song, Xiuying Chen, Rui Yan, Flood Sung

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

Comments 25 pages, 13 figures, and 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01864 2025-06-13 cs.CY cs.AI 57%

(A)I Am Not a Lawyer, But...: Engaging Legal Experts towards Responsible LLM Policies for Legal Advice

Inyoung Cheong, King Xia, K. J. Kevin Feng, Quan Ze Chen, Amy X. Zhang

机构 * University of Washington(华盛顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09977 2025-06-12 cs.AI 57%

How Do People Revise Inconsistent Beliefs? Examining Belief Revision in Humans with User Studies

Stylianos Loukas Vasileiou, Antonio Rago, Maria Vanina Martinez, William Yeoh

机构 * Washington University in St. Louis(华盛顿大学圣路易斯分校) Imperial College London(伦敦帝国学院) Artificial Intelligence Research Institute (IIIA-CSIC)(人工智能研究所(IIIA-CSIC))

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00103 2025-06-12 cs.CL 57%

Writing-Zero: Bridge the Gap Between Non-verifiable Tasks and Verifiable Rewards

Ruipeng Jia, Yunyi Yang, Yongbo Gai, Kai Luo, Shihao Huang, Jianhe Lin, Xiaoxi Jiang, Guanjun Jiang

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17194 2025-06-12 cs.LG 57%

Representation Shattering in Transformers: A Synthetic Study with Knowledge Editing

Kento Nishi, Rahul Ramesh, Maya Okawa, Mikail Khona, Hidenori Tanaka, Ekdeep Singh Lubana

机构 * CBS-NTT Program in Physics of Intelligence, Harvard University Harvard College Informatics Lab, NTT Research Inc. Information Science, University of Pennsylvania Department of Physics, Massachusetts Institute of Technology

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

Comments Accepted to ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09414 2025-06-12 cs.CL cs.IR 57%

PGDA-KGQA: A Prompt-Guided Generative Framework with Multiple Data Augmentation Strategies for Knowledge Graph Question Answering

Xiujun Zhou, Pingjian Zhang, Deyou Tang

机构 * School of Software Engineering(软件工程学院) South China University of Technology(华南理工大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 13 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07280 2025-06-11 cs.CV cs.AI 57%

From Generation to Generalization: Emergent Few-Shot Learning in Video Diffusion Models

Pablo Acuaviva, Aram Davtyan, Mariam Hassan, Sebastian Stapf, Ahmad Rahimi, Alexandre Alahi, Paolo Favaro

机构 * University of Bern(伯恩大学) EPFL(瑞士联邦理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments 27 pages, 23 figures, 9 tables. Project page: https://pabloacuaviva.github.io/Gen2Gen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09081 2025-06-11 cs.CV cs.AI 57%

Everything Can Be Described in Words: A Simple Unified Multi-Modal Framework with Semantic and Temporal Alignment

Xiaowei Bi, Zheyuan Xu

机构 * Northwestern University(西北大学) IEEE Member(IEEE会员)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08120 2025-06-11 cs.CL 57%

Conservative Bias in Large Language Models: Measuring Relation Predictions

Toyin Aguda, Erik Wilson, Allan Anzagira, Simerjot Kaur, Charese Smiley

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08007 2025-06-10 cs.CL 57%

Reinforcement Pre-Training

Qingxiu Dong, Li Dong, Yao Tang, Tianzhu Ye, Yutao Sun, Zhifang Sui, Furu Wei

机构 * Microsoft Research(微软研究院) Peking University(北京大学) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06438 2025-06-10 cs.AI 57%

Reliable Collaborative Conversational Agent System Based on LLMs and Answer Set Programming

Yankai Zeng, Gopal Gupta

机构 * Department of Computer Science University of Texas at Dallas(计算机科学系德克萨斯大学达拉斯分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.04873 2025-06-10 cs.CL 57%

Synergizing Unsupervised Episode Detection with LLMs for Large-Scale News Events

Priyanka Kargupta, Yunyi Zhang, Yizhu Jiao, Siru Ouyang, Jiawei Han

机构 * Siebel School of Computing and Data Science(塞比尔计算与数据科学学院) University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments ACL 2025 Main Conference. Code available here: https://github.com/pkargupta/epimine

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06377 2025-06-10 cs.CY cs.LG econ.EM stat.CO 57%

Evaluating Large Language Model Capabilities in Assessing Spatial Econometrics Research

Giuseppe Arbia, Luca Morandini, Vincenzo Nardelli

机构 * Department of Statistical Sciences, Università Cattolica del Sacro Cuore(统计科学系,天主教圣心大学) School of Computing and Information Systems, The University of Melbourne(计算与信息系统学院,墨尔本大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08208 2025-06-10 cs.IR cs.AI 57%

LLM4DSR: Leveraging Large Language Model for Denoising Sequential Recommendation

Bohao Wang, Feng Liu, Changwang Zhang, Jiawei Chen, Yudi Wu, Sheng Zhou, Xingyu Lou, Jun Wang, Yan Feng, Chun Chen, Can Wang

机构 * Zhejiang University(浙江大学) OPPO Co Ltd(OPPO公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01744 2025-06-09 cs.CV cs.CL 57%

Leopard: A Vision Language Model For Text-Rich Multi-Image Tasks

Mengzhao Jia, Wenhao Yu, Kaixin Ma, Tianqing Fang, Zhihan Zhang, Siru Ouyang, Hongming Zhang, Dong Yu, Meng Jiang

机构 * University of Notre Dame(诺丁汉大学) Tencent AI Seattle Lab(腾讯AI西雅图实验室) UIUC(伊利诺伊大学香槟分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Our code is available at https://github.com/tencent-ailab/Leopard

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14887 2025-06-09 cs.IR cs.LG 57%

Pseudo Relevance Feedback is Enough to Close the Gap Between Small and Large Dense Retrieval Models

Hang Li, Xiao Wang, Bevan Koopman, Guido Zuccon

机构 * The University of Queensland(昆士兰大学) University of International Business and Economics(国际商务经济大学) CSIRO(澳大利亚联邦科学与工业研究组织)

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04679 2025-06-06 cs.CL 57%

Normative Conflicts and Shallow AI Alignment

Raphaël Millière

机构 * Raphaël Millière

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments Published in Philosophical Studies

Journal ref Milliere, R. (2025). Normative conflicts and shallow AI alignment. Philosophical Studies, 1-44

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04642 2025-06-06 cs.CL 57%

TaDA: Training-free recipe for Decoding with Adaptive KV Cache Compression and Mean-centering

Vinay Joshi, Pratik Prabhanjan Brahma, Zicheng Liu, Emad Barsoum

机构 * AMD

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

Comments ACL-2025 industry-track accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04627 2025-06-05 physics.comp-ph cs.LG physics.data-an 57%

Is the end of Insight in Sight ?

Jean-Michel Tucny, Mihir Durve, Sauro Succi

机构 * Department of Civil, Computer Science, and Aeronautical Technologies Engineering, Università degli Studi Roma Tre(罗马三大学土木、计算机科学与航空技术工程系) Center for Life Nano- & Neuro-Science, Italian Institute of Technology (IIT)(生命纳米与神经科学中心,意大利理工学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

Comments 15 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏