arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2502.18873 2025-02-27 cs.AI cs.CL 84%

Multi-LLM Collaborative Search for Complex Problem Solving

Sen Yang, Yafu Li, Wai Lam, Yu Cheng

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18431 2025-02-26 cs.CL cs.AI 84%

TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning

Frederikus Hudi, Genta Indra Winata, Ruochen Zhang, Alham Fikri Aji

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16707 2025-02-25 cs.RO cs.AI cs.LG 84%

Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation

Yunhai Feng, Jiaming Han, Zhuoran Yang, Xiangyu Yue, Sergey Levine, Jianlan Luo

专题命中 推理与问题求解 :language model(title,abstract);post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03035 2025-02-25 cs.CL cs.AI 84%

Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning

Zhen Li, Yupeng Su, Runming Yang, Congkai Xie, Zheng Wang, Zhongwei Xie, Ngai Wong, Hongxia Yang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15120 2025-02-24 cs.CL cs.AI 84%

Unveiling Reasoning Thresholds in Language Models: Scaling, Fine-Tuning, and Interpretability through Attention Maps

Yen-Che Hsiao, Abhishek Dutta

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13475 2025-02-24 cs.CL cs.AI 84%

LLM should think and action as a human

Haun Leung, ZiNan Wang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13173 2025-02-20 cs.LG cs.AI 84%

Thinking Preference Optimization

Wang Yang, Hongye Jin, Jingfeng Yang, Vipin Chaudhary, Xiaotian Han

专题命中 推理与问题求解 :preference optimization(title,abstract);SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14545 2025-02-19 cs.CL cs.AI 84%

Tell me what I need to know: Exploring LLM-based (Personalized) Abstractive Multi-Source Meeting Summarization

Frederic Kirstein, Terry Ruas, Robert Kratel, Bela Gipp

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref EMNLP 2024 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09819 2025-02-17 cs.CV cs.AI cs.GR cs.LG cs.PL 84%

A Solver-Aided Hierarchical Language for LLM-Driven CAD Design

Benjamin T. Jones, Felix Hähnlein, Zihan Zhang, Maaz Ahmad, Vladimir Kim, Adriana Schulz

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17874 2025-02-11 cs.CL cs.AI 84%

Evaluating LLM Reasoning in the Operations Research Domain with ORQA

Mahdi Mostajabdaveh, Timothy T. Yu, Samarendra Chandan Bindu Dash, Rindranirina Ramamonjison, Jabo Serge Byusa, Giuseppe Carenini, Zirui Zhou, Yong Zhang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 10 figures. Accepted and to be published in AAAI25

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10645 2025-02-11 cs.RO cs.AI cs.CL cs.HC 84%

Interactive Task Planning with Language Models

Boyi Li, Philipp Wu, Pieter Abbeel, Jitendra Malik

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Transactions on Machine Learning Research (TMLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04404 2025-02-10 cs.CL cs.AI 84%

Step Back to Leap Forward: Self-Backtracking for Boosting Reasoning of Language Models

Xiao-Wen Yang, Xuan-Yi Zhu, Wen-Da Wei, Ding-Chu Zhang, Jie-Jing Shao, Zhi Zhou, Lan-Zhe Guo, Yu-Feng Li

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments This is a preprint under review, 15 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10642 2025-01-27 cs.CL cs.LG 84%

Self-playing Adversarial Language Game Enhances LLM Reasoning

Pengyu Cheng, Tianhao Hu, Han Xu, Zhisong Zhang, Zheng Yuan, Yong Dai, Lei Han, Nan Du, Xiaolong Li

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13080 2025-01-23 cs.CL cs.CR cs.LG 84%

Refining Input Guardrails: Enhancing LLM-as-a-Judge Efficiency Through Chain-of-Thought Fine-Tuning and Alignment

Melissa Kazemi Rad, Huy Nghiem, Andy Luo, Sahil Wadhwa, Mohammad Sorower, Stephen Rawls

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04880 2025-01-10 cs.CL cs.LG 84%

Leveraging Log Probabilities in Language Models to Forecast Future Events

Tommaso Soru, Jim Marshall

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 5 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11694 2025-01-03 cs.CL cs.AI 84%

Enhancing LLM Reasoning with Reward-guided Tree Search

Jinhao Jiang, Zhipeng Chen, Yingqian Min, Jie Chen, Xiaoxue Cheng, Jiapeng Wang, Yiru Tang, Haoxiang Sun, Jia Deng, Wayne Xin Zhao, Zheng Liu, Dong Yan, Jian Xie, Zhongyuan Wang, Ji-Rong Wen

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Technical Report on Slow Thinking with LLMs: I

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15386 2024-11-26 cs.AI cs.CY cs.LG 84%

Inducing Human-like Biases in Moral Reasoning Language Models

Artem Karpov, Seong Hah Cho, Austin Meek, Raymond Koopmanschap, Lucy Farnik, Bogdan-Ionut Cirstea

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to the 2nd Workshop on Unifying Representations in Neural Models (UniReps) at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15000 2024-11-20 cs.CL cs.LG 84%

Divide-or-Conquer? Which Part Should You Distill Your LLM?

Zhuofeng Wu, He Bai, Aonan Zhang, Jiatao Gu, VG Vinod Vydiswaran, Navdeep Jaitly, Yizhe Zhang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Findings of the Association for Computational Linguistics: EMNLP 2024

Journal ref 2024.findings-emnlp.145

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05013 2024-11-11 q-fin.ST cs.AI cs.LG q-fin.TR 84%

Enhancing literature review with LLM and NLP methods. Algorithmic trading case

Stanisław Łaniewski, Robert Ślepaczuk

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06458 2024-11-06 cs.AI cs.CL 84%

Towards Autonomous Agents: Adaptive-planning, Reasoning, and Acting in Language Models

Abhishek Dutta, Yen-Che Hsiao

专题命中 推理与问题求解 :language model(title,abstract);language agent(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22372 2024-10-31 cs.LG cs.AI 84%

A Hierarchical Language Model For Interpretable Graph Reasoning

Sambhav Khurana, Xiner Li, Shurui Gui, Shuiwang Ji

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12327 2024-10-29 cs.AI cs.CL cs.CY cs.MA econ.GN q-fin.EC 84%

Shall We Team Up: Exploring Spontaneous Cooperation of Competing LLM Agents

Zengqing Wu, Run Peng, Shuyuan Zheng, Qianying Liu, Xu Han, Brian Inhyuk Kwon, Makoto Onizuka, Shaojie Tang, Chuan Xiao

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024 Findings. Source codes available at https://github.com/wuzengqing001225/SABM_ShallWeTeamUp

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08400 2024-10-25 cs.CL cs.AI 84%

Self-training Language Models for Arithmetic Reasoning

Marek Kadlčík, Michal Štefánik

专题命中 推理与问题求解 :language model(title,abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments To appear in Findings of EMNLP 2024. Reproducible implementations and references to resulting models can be found on https://github.com/prompteus/calc-x

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08146 2024-10-11 cs.LG cs.CL 84%

Rewarding Progress: Scaling Automated Process Verifiers for LLM Reasoning

Amrith Setlur, Chirag Nagpal, Adam Fisch, Xinyang Geng, Jacob Eisenstein, Rishabh Agarwal, Alekh Agarwal, Jonathan Berant, Aviral Kumar

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05928 2024-10-10 cs.CV cs.AI cs.CL 84%

Beyond Captioning: Task-Specific Prompting for Improved VLM Performance in Mathematical Reasoning

Ayush Singh, Mansi Gupta, Shivank Garg, Abhinav Kumar, Vansh Agrawal

专题命中 推理与问题求解 :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05318 2024-10-10 cs.LG cs.AI 84%

Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification

Zhenwen Liang, Ye Liu, Tong Niu, Xiangliang Zhang, Yingbo Zhou, Semih Yavuz

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01792 2024-10-07 cs.CL cs.AI 84%

When a language model is optimized for reasoning, does it still show embers of autoregression? An analysis of OpenAI o1

R. Thomas McCoy, Shunyu Yao, Dan Friedman, Mathew D. Hardy, Thomas L. Griffiths

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 6 pages; updated to fix typo in Fig 4 caption

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15454 2024-09-25 cs.CL cs.AI 84%

In-Context Learning May Not Elicit Trustworthy Reasoning: A-Not-B Errors in Pretrained Language Models

Pengrui Han, Peiyang Song, Haofei Yu, Jiaxuan You

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09239 2024-09-24 cs.CL cs.AI 84%

Autoregressive + Chain of Thought = Recurrent: Recurrence's Role in Language Models' Computability and a Revisit of Recurrent Transformer

Xiang Zhang, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10502 2024-09-17 cs.LG cs.CL 84%

Causal Language Modeling Can Elicit Search and Reasoning Capabilities on Logic Puzzles

Kulin Shah, Nishanth Dikkala, Xin Wang, Rina Panigrahy

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏