arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18875 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18875 篇

2501.15781 2025-06-04 cs.CL cs.AI cs.LG 90%

Large Language Models to Diffusion Finetuning

Edoardo Cetin, Tianyu Zhao, Yujin Tang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Camera-ready version, presented at ICML 2025. Code available at: https://github.com/SakanaAI/L2D

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24710 2025-06-02 cs.LG cs.AI cs.CL 90%

Causal-aware Large Language Models: Enhancing Decision-Making Through Learning, Adapting and Acting

Wei Chen, Jiahao Zhang, Haipeng Zhu, Boyan Xu, Zhifeng Hao, Keli Zhang, Junjian Ye, Ruichu Cai

机构 * School of Computer Science, Guangdong University of Technology(广东技术大学计算机科学学院) College of Mathematics and Computer Science, Shantou University(汕头大学数学与计算机科学学院) Huawei Noah’s Ark Lab, Huawei(华为诺亚实验室) Peng Cheng Laboratory, Shenzhen, China(鹏城实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22320 2025-05-29 cs.NI 90%

Chain-of-Thought for Large Language Model-empowered Wireless Communications

Xudong Wang, Jian Zhu, Ruichen Zhang, Lei Feng, Dusit Niyato, Jiacheng Wang, Hongyang Du, Shiwen Mao, Zhu Han

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02454 2025-05-23 cs.CL cs.AI cs.IR cs.LG 90%

Graph-based Confidence Calibration for Large Language Models

Yukun Li, Sijia Wang, Lifu Huang, Li-Ping Liu

机构 * Department of Computer Science Tufts University(塔夫茨大学计算机科学系) Department of Computer Science Virginia Tech(弗吉尼亚理工大学计算机科学系) Department of Computer Science Virginia Tech, University of California, Davis(弗吉尼亚理工大学计算机科学系,加州大学戴维斯分校计算机科学系)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14150 2025-05-21 cs.CL cs.AI cs.LG stat.ML 90%

Walk the Talk? Measuring the Faithfulness of Large Language Model Explanations

Katie Matton, Robert Osazuwa Ness, John Guttag, Emre Kıcıman

机构 * MIT(麻省理工学院) Microsoft Research(微软研究院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 66 pages, 14 figures, 40 tables; ICLR 2025 (spotlight) camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14432 2025-05-05 cs.CV 90%

Insight-V: Exploring Long-Chain Visual Reasoning with Multimodal Large Language Models

Yuhao Dong, Zuyan Liu, Hai-Long Sun, Jingkang Yang, Winston Hu, Yongming Rao, Ziwei Liu

机构 * S-Lab, NTU(NTU的S-Lab) Tencent(腾讯) Tsinghua University(清华大学) Nanjing University(南京大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20769 2025-04-30 cs.CL cs.AI cs.LG 90%

Chain-of-Defensive-Thought: Structured Reasoning Elicits Robustness in Large Language Models against Reference Corruption

Wenxiao Wang, Parsa Hosseini, Soheil Feizi

机构 * Department of Computer Science, University of Maryland, College Park, Maryland, USA(计算机科学系,马里兰大学,College Park,马里兰,美国)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03026 2025-04-16 cs.RO cs.AI cs.CL cs.CV cs.LG 90%

LanguageMPC: Large Language Models as Decision Makers for Autonomous Driving

Hao Sha, Yao Mu, Yuxuan Jiang, Li Chen, Chenfeng Xu, Ping Luo, Shengbo Eben Li, Masayoshi Tomizuka, Wei Zhan, Mingyu Ding

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03321 2025-04-07 cs.AI cs.CL cs.LG 90%

Towards More Accurate US Presidential Election via Multi-step Reasoning with Large Language Models

Chenxiao Yu, Zhaotian Weng, Yuangang Li, Zheng Li, Xiyang Hu, Yue Zhao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This research is ongoing work. Xiyang Hu and Yue Zhao are the corresponding authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20430 2025-03-27 cs.IR 90%

RALLRec+: Retrieval Augmented Large Language Model Recommendation with Reasoning

Sichun Luo, Jian Xu, Xiaojie Zhang, Linrong Wang, Sicong Liu, Hanxu Hou, Linqi Song

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments arXiv admin note: substantial text overlap with arXiv:2502.06101

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14395 2025-03-06 cs.CL cs.AI cs.LG 90%

PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?

Mitodru Niyogi, Arnab Bhattacharya

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);SLM(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02611 2025-03-04 cs.AI cs.CL cs.LG 90%

FCoReBench: Can Large Language Models Solve Challenging First-Order Combinatorial Reasoning Problems?

Chinmay Mittal, Krishna Kartik, Mausam, Parag Singla

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11775 2025-02-18 cs.CV 90%

video-SALMONN-o1: Reasoning-enhanced Audio-visual Large Language Model

Guangzhi Sun, Yudong Yang, Jimin Zhuang, Changli Tang, Yixuan Li, Wei Li, Zejun MA, Chao Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14075 2025-02-18 cs.CL cs.AI cs.LG 90%

$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models

Chengkun Cai, Xu Zhao, Yucheng Du, Haoliang Liu, Lei Li

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11132 2025-02-17 cs.CL cs.AI cs.LG 90%

RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents

Weizhe Chen, Sven Koenig, Bistra Dilkina

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23511 2025-02-11 cs.CL cs.AI cs.LG 90%

Dynamic Strategy Planning for Efficient Question Answering with Large Language Models

Tanmay Parekh, Pradyot Prakash, Alexander Radovic, Akshay Shekher, Denis Savenkov

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11044 2025-02-11 cs.CL cs.AI cs.LG 90%

Evaluating the Performance of Large Language Models via Debates

Behrad Moniri, Hamed Hassani, Edgar Dobriban

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14536 2025-02-06 cs.CL cs.AI cs.LG cs.SD eess.AS 90%

Spoken Language Intelligence of Large Language Models for Language Learning

Linkai Peng, Baorian Nuchged, Yingming Gao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 28 pages, 7 figures, Preprint Feb 04, 2025 update: Add Deepseek R1 performance

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17097 2025-01-28 cs.NI 90%

Reasoning AI Performance Degradation in 6G Networks with Large Language Models

Liming Huang, Yulei Wu, Dimitra Simeonidou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments IEEE WCNC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.13936 2025-01-27 cs.AI cs.CL cs.LG 90%

Evaluating Computational Accuracy of Large Language Models in Numerical Reasoning Tasks for Healthcare Applications

Arjun R. Malghan

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04136 2024-12-31 cs.NI 90%

Large Language Models for Wireless Networks: An Overview from the Prompt Engineering Perspective

Hao Zhou, Chengming Hu, Dun Yuan, Ye Yuan, Di Wu, Xi Chen, Hina Tabassum, Xue Liu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.19707 2024-12-30 cs.AI cs.CL cs.LG 90%

Toward Adaptive Reasoning in Large Language Models with Thought Rollback

Sijia Chen, Baochun Li

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2024 camera-ready version with 24 pages and 12 figures. Code repo with all prompts: https://github.com/iQua/llmpebase/tree/main/examples/ThoughtRollback

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09345 2024-12-13 econ.GN q-fin.EC 90%

Delving into Youth Perspectives on In-game Gambling-like Elements: A Proof-of-Concept Study Utilising Large Language Models for Analysing User-Generated Text Data

Thomas Krause, Steffen Otterbach, Johannes Singer

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01333 2024-12-03 cs.SE 90%

Can Large Language Models Serve as Evaluators for Code Summarization?

Yang Wu, Yao Wan, Zhaoyang Chu, Wenting Zhao, Ye Liu, Hongyu Zhang, Xuanhua Shi, Philip S. Yu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08273 2024-11-19 cs.CL cs.AI cs.LG 90%

Large Language Models are Null-Shot Learners

Pittawat Taveekitworachai, Febri Abdullah, Ruck Thawonmas

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 28 pages; v2: added Gemini Pro results, error analysis, and a discussion on confabulation; v3: see its extended version, an EMNLP 2024 paper, at https://aclanthology.org/2024.emnlp-main.740/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02320 2024-11-05 cs.SE 90%

An Empirical Study on the Code Refactoring Capability of Large Language Models

Jonathan Cordeiro, Shayan Noei, Ying Zou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13094 2024-11-05 cs.CL cs.AI cs.LG 90%

Exploring and Benchmarking the Planning Capabilities of Large Language Models

Bernd Bohnet, Azade Nova, Aaron T Parisi, Kevin Swersky, Katayoon Goshvadi, Hanjun Dai, Dale Schuurmans, Noah Fiedel, Hanie Sedghi

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15371 2024-10-30 cs.LG cs.AI cs.CL 90%

Can large language models explore in-context?

Akshay Krishnamurthy, Keegan Harris, Dylan J. Foster, Cyril Zhang, Aleksandrs Slivkins

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS 2024. This version: added references to related and concurrent work

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06328 2024-10-15 cs.CL cs.AI cs.LG 90%

Auto-Evolve: Enhancing Large Language Model's Performance via Self-Reasoning Framework

Krishna Aswani, Huilin Lu, Pranav Patankar, Priya Dhalwani, Iris Tan, Jayant Ganeshmohan, Simon Lacasse

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01782 2024-10-03 cs.CL cs.AI cs.LG 90%

Open-RAG: Enhanced Retrieval-Augmented Reasoning with Open-Source Large Language Models

Shayekh Bin Islam, Md Asib Rahman, K S M Tozammel Hossain, Enamul Hoque, Shafiq Joty, Md Rizwan Parvez

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2024 Findings. Website: https://openragmoe.github.io/. 14 pages, 7 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏