arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 19037 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19037 篇

2411.00186 2024-11-04 cs.LG cs.AI 79%

Self-Healing Machine Learning: A Framework for Autonomous Adaptation in Real-World Environments

Paulius Rauba, Nabeel Seedat, Krzysztof Kacprzyk, Mihaela van der Schaar

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Advances in Neural Information Processing Systems 38 (NeurIPS 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17503 2024-10-31 cs.SE cs.AI cs.CL cs.PL 79%

Code Repair with LLMs gives an Exploration-Exploitation Tradeoff

Hao Tang, Keya Hu, Jin Peng Zhou, Sicheng Zhong, Wei-Long Zheng, Xujie Si, Kevin Ellis

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21741 2024-10-30 cs.CL cs.AI 79%

Enhancing Financial Question Answering with a Multi-Agent Reflection Framework

Sorouralsadat Fatemi, Yuheng Hu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ICAIF 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20274 2024-10-29 cs.LG cs.CL cs.SC 79%

Library Learning Doesn't: The Curious Case of the Single-Use "Library"

Ian Berlot-Attwell, Frank Rudzicz, Xujie Si

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 24 pages, 7 figures. Accepted to the 4th MATH-AI Workshop at NeurIPS'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04669 2024-10-29 cs.LG cs.CL 79%

Towards a Theoretical Understanding of the 'Reversal Curse' via Training Dynamics

Hanlin Zhu, Baihe Huang, Shaolun Zhang, Michael Jordan, Jiantao Jiao, Yuandong Tian, Stuart Russell

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 41 pages, 18 figures, NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16802 2024-10-25 cs.CL cs.LG 79%

AutoPSV: Automated Process-Supervised Verifier

Jianqiao Lu, Zhiyang Dou, Hongru Wang, Zeyu Cao, Jianbo Dai, Yingjia Wan, Zhijiang Guo

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by NeurIPS 2024 Poster, 21 pages, 1 figure, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14622 2024-10-24 cs.IR cs.AI cs.CL cs.DL 79%

From Keywords to Structured Summaries: Streamlining Scholarly Information Access

Mahsa Shamsabadi, Jennifer D'Souza

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 3 figures | Accepted for publication as a poster paper at the International Semantic Web Conference (ISWC 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14690 2024-10-22 cs.LG cs.AI cs.CV 79%

Rethinking VLMs and LLMs for Image Classification

Avi Cooper, Keizo Kato, Chia-Hsien Shih, Hiroaki Yamane, Kasper Vinken, Kentaro Takemoto, Taro Sunagawa, Hao-Wei Yeh, Jin Yamanaka, Ian Mason, Xavier Boix

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08985 2024-10-22 cs.AI cs.CL 79%

Towards Trustworthy Knowledge Graph Reasoning: An Uncertainty Aware Perspective

Bo Ni, Yu Wang, Lu Cheng, Erik Blasch, Tyler Derr

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14198 2024-10-21 cs.CL cs.AI 79%

Supervised Chain of Thought

Xiang Zhang, Dujian Ding

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09988 2024-10-17 cs.AI cs.CL cs.RO 79%

Details Make a Difference: Object State-Sensitive Neurorobotic Task Planning

Xiaowen Sun, Xufeng Zhao, Jae Hee Lee, Wenhao Lu, Matthias Kerzel, Stefan Wermter

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ICANN24, Switzerland

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09220 2024-10-15 cs.CL cs.CY cs.LG 79%

M3Hop-CoT: Misogynous Meme Identification with Multimodal Multi-hop Chain-of-Thought

Gitanjali Kumari, Kirtan Jain, Asif Ekbal

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments 34 Pages. Accepted in The 2024 Conference on Empirical Methods in Natural Language Processing (EMNLP 2024). Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19924 2024-10-15 cs.AI cs.LG cs.RO 79%

On The Planning Abilities of OpenAI's o1 Models: Feasibility, Optimality, and Generalizability

Kevin Wang, Junbo Li, Neel P. Bhatt, Yihan Xi, Qiang Liu, Ufuk Topcu, Zhangyang Wang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Code available at https://github.com/VITA-Group/o1-planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11012 2024-10-15 cs.CL cs.AI 79%

Connecting the Dots: Evaluating Abstract Reasoning Capabilities of LLMs Using the New York Times Connections Word Game

Prisha Samadarshi, Mariam Mustafa, Anushka Kulkarni, Raven Rothkopf, Tuhin Chakrabarty, Smaranda Muresan

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18344 2024-10-15 cs.CL cs.AI 79%

Focus on Your Question! Interpreting and Mitigating Toxic CoT Problems in Commonsense Reasoning

Jiachun Li, Pengfei Cao, Chenhao Wang, Zhuoran Jin, Yubo Chen, Daojian Zeng, Kang Liu, Jun Zhao

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted as a long paper to ACL 2024 Main, 25 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10712 2024-10-15 cs.CV cs.AI cs.CL 79%

Q&A Prompts: Discovering Rich Visual Clues through Mining Question-Answer Prompts for VQA requiring Diverse World Knowledge

Haibo Wang, Weifeng Ge

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted by ECCV'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05801 2024-10-10 cs.CL cs.AI 79%

Retrieving, Rethinking and Revising: The Chain-of-Verification Can Improve Retrieval Augmented Generation

Bolei He, Nuo Chen, Xinran He, Lingyong Yan, Zhenkai Wei, Jinchang Luo, Zhen-Hua Ling

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2024 Findings. 9 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19356 2024-10-10 cs.CL cs.CY cs.LG 79%

DiVERT: Distractor Generation with Variational Errors Represented as Text for Math Multiple-choice Questions

Nigel Fernandez, Alexander Scarlatos, Wanyong Feng, Simon Woodhead, Andrew Lan

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2024: The 2024 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05045 2024-10-08 cs.AI cs.CL cs.RO 79%

Can LLMs plan paths with extra hints from solvers?

Erik Wu, Sayan Mitra

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03806 2024-10-08 cs.LG cs.CL 79%

Metadata Matters for Time Series: Informative Forecasting with Transformers

Jiaxiang Dong, Haixu Wu, Yuxuan Wang, Li Zhang, Jianmin Wang, Mingsheng Long

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01687 2024-10-07 cs.CL cs.AI 79%

Deciphering the Factors Influencing the Efficacy of Chain-of-Thought: Probability, Memorization, and Noisy Reasoning

Akshara Prabhakar, Thomas L. Griffiths, R. Thomas McCoy

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024 Findings; 9 pages plus references and appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02428 2024-10-04 cs.CL cs.AI 79%

Collective Critics for Creative Story Generation

Minwook Bae, Hyounghun Kim

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024 (36 pages)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13647 2024-10-02 cs.CL cs.AI 79%

Weak-to-Strong Reasoning

Yuqing Yang, Yan Ma, Pengfei Liu

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments EMNLP Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.13731 2024-09-27 cs.CL cs.AI 79%

KAG: Boosting LLMs in Professional Domains via Knowledge Augmented Generation

Lei Liang, Mengshu Sun, Zhengke Gui, Zhongshu Zhu, Zhouyu Jiang, Ling Zhong, Yuan Qu, Peilong Zhao, Zhongpu Bo, Jin Yang, Huaidong Xiong, Lin Yuan, Jun Xu, Zaoyang Wang, Zhiqiang Zhang, Wen Zhang, Huajun Chen, Wenguang Chen, Jun Zhou

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15277 2024-09-24 cs.CL cs.AI 79%

A Preliminary Study of o1 in Medicine: Are We Closer to an AI Doctor?

Yunfei Xie, Juncheng Wu, Haoqin Tu, Siwei Yang, Bingchen Zhao, Yongshuo Zong, Qiao Jin, Cihang Xie, Yuyin Zhou

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The first four authors contributed equally, project page available at https://ucsc-vlaa.github.io/o1_medicine/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09916 2024-09-17 cs.CL cs.AI 79%

SFR-RAG: Towards Contextually Faithful LLMs

Xuan-Phi Nguyen, Shrey Pandit, Senthil Purushwalkam, Austin Xu, Hailin Chen, Yifei Ming, Zixuan Ke, Silvio Savarese, Caiming Xong, Shafiq Joty

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08069 2024-09-13 cs.AI cs.CL 79%

TravelAgent: An AI Assistant for Personalized Travel Planning

Aili Chen, Xuyang Ge, Ziquan Fu, Yanghua Xiao, Jiangjie Chen

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03271 2024-09-06 cs.AI cs.CL cs.HC 79%

Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation

Yu Wang, Shiwan Zhao, Zhihu Wang, Heyuan Huang, Ming Fan, Yubo Zhang, Zhixing Wang, Haijun Wang, Ting Liu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15092 2024-09-04 cs.AI cs.CL 79%

Dissociation of Faithful and Unfaithful Reasoning in LLMs

Evelyn Yee, Alice Li, Chenyu Tang, Yeon Ho Jung, Ramamohan Paturi, Leon Bergen

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments code published at https://github.com/CoTErrorRecovery/CoTErrorRecovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13915 2024-08-27 cs.CL cs.AI 79%

LLMs are Superior Feedback Providers: Bootstrapping Reasoning for Lie Detection with Self-Generated Feedback

Tanushree Banerjee, Richard Zhu, Runzhe Yang, Karthik Narasimhan

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 19 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏