arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2506.16359 2025-08-18 q-bio.QM 83%

SHREC: A Framework for Advancing Next-Generation Computational Phenotyping with Large Language Models

Sarah Pungitore, Shashank Yadav, Molly Douglas, Jarrod Mosier, Vignesh Subbian

专题命中 推理与问题求解 :large language model(title);language model(title)

Comments Submitted to PLOS Digital Health

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00845 2025-06-26 cs.CL cs.AI cs.LG 83%

Rewarding Graph Reasoning Process makes LLMs more Generalized Reasoners

Miao Peng, Nuo Chen, Zongrui Suo, Jia Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州))

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments Accepted to KDD 2025 Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05478 2025-06-18 cs.CL cs.AI cs.CV cs.LG cs.RO 83%

Language and Planning in Robotic Navigation: A Multilingual Evaluation of State-of-the-Art Models

Malak Mansour, Ahmed Aly, Bahey Tharwat, Sarim Hashmi, Dong An, Ian Reid

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments This work has been accepted for presentation at LM4Plan@AAAI'25. For more details, please check: https://llmforplanning.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23743 2025-06-06 cs.CL cs.AI cs.LG 83%

What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective

Ming Li, Yanhong Li, Tianyi Zhou

机构 * University of Maryland(马里兰大学) University of Chicago(芝加哥大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments ACL2025 main, Camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02911 2025-06-04 cs.CL cs.AI cs.CE cs.HC cs.LG 83%

Cell-o1: Training LLMs to Solve Single-Cell Reasoning Puzzles with Reinforcement Learning

Yin Fang, Qiao Jin, Guangzhi Xiong, Bowen Jin, Xianrui Zhong, Siru Ouyang, Aidong Zhang, Jiawei Han, Zhiyong Lu

机构 * National Institutes of Health(美国国立卫生研究院) University of Virginia(弗吉尼亚大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments 28 pages; 16 tables; 7 figures; Code: https://github.com/ncbi-nlp/cell-o1

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22290 2025-05-29 cs.AI cs.CL cs.LG 83%

Rethinking the Unsolvable: When In-Context Search Meets Test-Time Scaling

Fanzeng Xia, Yidong Luo, Tinko Sebastian Bartels, Yaqi Xu, Tongxin Li

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.12249 2025-05-20 cs.CL cs.AI cs.LG 83%

LLMs are not Zero-Shot Reasoners for Biomedical Information Extraction

Aishik Nagar, Viktor Schlegel, Thanh-Tung Nguyen, Hao Li, Yuping Wu, Kuluhan Binici, Stefan Winkler

机构 * ASUS Intelligent Cloud Services (AICS)(ASUS智能云服务) Imperial College London(伦敦帝国学院) University of Manchester(曼彻斯特大学) National University of Singapore(新加坡国立大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12183 2025-05-09 cs.CL cs.AI cs.LG 83%

To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning

Zayne Sprague, Fangcong Yin, Juan Diego Rodriguez, Dongwei Jiang, Manya Wadhwa, Prasann Singhal, Xinyu Zhao, Xi Ye, Kyle Mahowald, Greg Durrett

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Johns Hopkins University(约翰霍普金斯大学) Princeton University(普林斯顿大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Published at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15249 2025-03-24 cs.CL cs.AI cs.DL cs.LG 83%

LitLLMs, LLMs for Literature Review: Are we there yet?

Shubham Agarwal, Gaurav Sahu, Abhay Puri, Issam H. Laradji, Krishnamurthy DJ Dvijotham, Jason Stanley, Laurent Charlin, Christopher Pal

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10639 2025-03-14 cs.CV 83%

GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing

Rongyao Fang, Chengqi Duan, Kun Wang, Linjiang Huang, Hao Li, Shilin Yan, Hao Tian, Xingyu Zeng, Rui Zhao, Jifeng Dai, Xihui Liu, Hongsheng Li

专题命中 推理与问题求解 :large language model(title);language model(title)

Comments Dataset and models are released in https://github.com/rongyaofang/GoT

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16048 2024-12-13 cs.CL cs.AI cs.LG 83%

How Likely Do LLMs with CoT Mimic Human Reasoning?

Guangsheng Bao, Hongbo Zhang, Cunxiang Wang, Linyi Yang, Yue Zhang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments COLING 2025 Camera Version (8 pages, 3 figures, 18 tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09971 2024-11-18 cs.CV cs.RO 83%

Explanation for Trajectory Planning using Multi-modal Large Language Model for Autonomous Driving

Shota Yamazaki, Chenyu Zhang, Takuya Nanri, Akio Shigekane, Siyuan Wang, Jo Nishiyama, Tao Chu, Kohei Yokosawa

专题命中 推理与问题求解 :large language model(title);language model(title)

Comments Accepted and presented at ECCV 2024 2nd Workshop on Vision-Centric Autonomous Driving (VCAD) on September 30, 2024. 13 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09407 2024-10-15 cs.CL cs.AI cs.LG 83%

CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device

Yicheng Fu, Raviteja Anantha, Jianpeng Cheng

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);small language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01560 2024-10-08 cs.CL cs.AI cs.LG 83%

OpenMathInstruct-2: Accelerating AI for Math with Massive Open-Source Instruction Data

Shubham Toshniwal, Wei Du, Ivan Moshkov, Branislav Kisacanin, Alexan Ayrapetyan, Igor Gitman

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19899 2024-10-01 cs.CV 83%

OpenKD: Opening Prompt Diversity for Zero- and Few-shot Keypoint Detection

Changsheng Lu, Zheyuan Liu, Piotr Koniusz

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12122 2024-09-19 cs.CL cs.AI cs.LG 83%

Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement

An Yang, Beichen Zhang, Binyuan Hui, Bofei Gao, Bowen Yu, Chengpeng Li, Dayiheng Liu, Jianhong Tu, Jingren Zhou, Junyang Lin, Keming Lu, Mingfeng Xue, Runji Lin, Tianyu Liu, Xingzhang Ren, Zhenru Zhang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11325 2024-07-17 cs.CV 83%

VISA: Reasoning Video Object Segmentation via Large Language Models

Cilin Yan, Haochen Wang, Shilin Yan, Xiaolong Jiang, Yao Hu, Guoliang Kang, Weidi Xie, Efstratios Gavves

专题命中 推理与问题求解 :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00071 2024-07-02 cs.AI cs.CL cs.ET cs.LG 83%

Combinatorial Reasoning: Selecting Reasons in Generative AI Pipelines via Combinatorial Optimization

Mert Esencan, Tarun Advaith Kumar, Ata Akbari Asanjan, P. Aaron Lott, Masoud Mohseni, Can Unlu, Davide Venturelli, Alan Ho

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18532 2024-06-27 cs.CL cs.AI cs.LG 83%

Symbolic Learning Enables Self-Evolving Agents

Wangchunshu Zhou, Yixin Ou, Shengwei Ding, Long Li, Jialong Wu, Tiannan Wang, Jiamin Chen, Shuai Wang, Xiaohua Xu, Ningyu Zhang, Huajun Chen, Yuchen Eleanor Jiang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);language agent(abstract)

Comments Code available at https://github.com/aiwaves-cn/agents

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12348 2024-06-11 cs.CL cs.AI cs.LG 83%

GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations

Jinhao Duan, Renming Zhang, James Diffenderfer, Bhavya Kailkhura, Lichao Sun, Elias Stengel-Eskin, Mohit Bansal, Tianlong Chen, Kaidi Xu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

Comments 26 pages; the first two authors contributed equally; GTBench HF Leaderboard: https://huggingface.co/spaces/GTBench/GTBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12871 2024-05-10 cs.CV cs.AI cs.CL cs.LG 83%

An Embodied Generalist Agent in 3D World

Jiangyong Huang, Silong Yong, Xiaojian Ma, Xiongkun Linghu, Puhao Li, Yan Wang, Qing Li, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ICML 2024. The first four authors contribute equally. Project page: https://embodied-generalist.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07938 2024-04-17 cs.HC cs.AI cs.CL cs.LG 83%

Large Language User Interfaces: Voice Interactive User Interfaces powered by LLMs

Syed Mekael Wasti, Ken Q. Pu, Ali Neshati

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted as peer-reviewed publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15464 2024-03-26 cs.CL cs.AI cs.LG cs.MA 83%

LLMs-based Few-Shot Disease Predictions using EHR: A Novel Approach Combining Predictive Agent Reasoning and Critical Agent Instruction

Hejie Cui, Zhuocheng Shen, Jieyu Zhang, Hui Shao, Lianhui Qin, Joyce C. Ho, Carl Yang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01599 2024-03-05 cs.CV cs.AI cs.CL cs.LG 83%

SCHEMA: State CHangEs MAtter for Procedure Planning in Instructional Videos

Yulei Niu, Wenliang Guo, Long Chen, Xudong Lin, Shih-Fu Chang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.06034 2023-11-13 q-bio.BM q-bio.PE 83%

Structure of the space of folding protein sequences defined by large language models

A. Zambon, R. Zecchina, G. Tiana

专题命中 推理与问题求解 :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.09009 2023-11-01 cs.CL cs.AI cs.LG 83%

How is ChatGPT's behavior changing over time?

Lingjiao Chen, Matei Zaharia, James Zou

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments add more evaluations on instruction following

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12823 2023-10-24 cs.CL cs.AI cs.LG 83%

AgentTuning: Enabling Generalized Agent Abilities for LLMs

Aohan Zeng, Mingdao Liu, Rui Lu, Bowen Wang, Xiao Liu, Yuxiao Dong, Jie Tang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16797 2023-10-02 cs.CL cs.AI cs.LG cs.NE 83%

Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution

Chrisantha Fernando, Dylan Banarse, Henryk Michalewski, Simon Osindero, Tim Rocktäschel

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.12485 2023-09-25 cs.CL cs.AI cs.LG 83%

Studying and improving reasoning in humans and machines

Nicolas Yax, Hernan Anlló, Stefano Palminteri

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments The paper is split in 4 parts : main text (pages 2-27), methods (pages 28-34), technical appendix (pages 35-45) and supplementary methods (pages 46-125)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08769 2023-08-21 cs.CV 83%

Chat-3D: Data-efficiently Tuning Large Language Model for Universal Dialogue of 3D Scenes

Zehan Wang, Haifeng Huang, Yang Zhao, Ziang Zhang, Zhou Zhao

专题命中 推理与问题求解 :large language model(title);language model(title)

Comments The project page is \url{https://chat-3d.github.io/}

详情

展开后加载摘要…

URL PDF HTML 收藏