arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2312.05209 2024-04-03 cs.AI cs.CL 88%

HALO: An Ontology for Representing and Categorizing Hallucinations in Large Language Models

Navapat Nananukul, Mayank Kejriwal

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments This paper has been accepted and orally presented in "SPIE Defense + Commercial Sensing (DCS 2024)" in National Harbor, Maryland, April 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02051 2024-03-29 cs.CV cs.AI cs.CL 88%

TimeChat: A Time-sensitive Multimodal Large Language Model for Long Video Understanding

Shuhuai Ren, Linli Yao, Shicheng Li, Xu Sun, Lu Hou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments CVPR 2024 camera-ready version, code is available at https://github.com/RenShuhuai-Andy/TimeChat

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09887 2024-03-28 cs.CL cs.AI 88%

Sabiá-2: A New Generation of Portuguese Large Language Models

Thales Sales Almeida, Hugo Abonizio, Rodrigo Nogueira, Ramon Pires

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05300 2024-03-27 cs.AI cs.CL 88%

Unleashing the Emergent Cognitive Synergy in Large Language Models: A Task-Solving Agent through Multi-Persona Self-Collaboration

Zhenhailong Wang, Shaoguang Mao, Wenshan Wu, Tao Ge, Furu Wei, Heng Ji

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments Accepted as a main conference paper at NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07954 2024-03-26 cs.AI cs.CL 88%

A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning

Ruixin Hong, Hongming Zhang, Xinyu Pang, Dong Yu, Changshui Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18807 2024-03-01 cs.CL cs.AI 88%

On the Decision-Making Abilities in Role-Playing using Large Language Models

Chenglei Shen, Guofu Xie, Xiao Zhang, Jun Xu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14053 2024-02-27 cs.LG cs.CL cs.SE 88%

Beyond Accuracy: Evaluating Self-Consistency of Code Large Language Models with IdentityChain

Marcus J. Min, Yangruibo Ding, Luca Buratti, Saurabh Pujar, Gail Kaiser, Suman Jana, Baishakhi Ray

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08955 2024-02-15 cs.AI cs.CL 88%

Using Counterfactual Tasks to Evaluate the Generality of Analogical Reasoning in Large Language Models

Martha Lewis, Melanie Mitchell

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17661 2024-01-01 cs.CL cs.AI cs.CV 88%

Gemini in Reasoning: Unveiling Commonsense in Multimodal Large Language Models

Yuqing Wang, Yun Zhao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Data and results are available at: https://github.com/EternityYW/Gemini-Commonsense-Evaluation/

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.08926 2023-12-19 cs.AI cs.CL 88%

Modeling Complex Mathematical Reasoning via Large Language Model based MathAgent

Haoran Liao, Qinyi Du, Shaohua Hu, Hao He, Yanyan Xu, Jidong Tian, Yaohui Jin

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments There are unfair comparisons on miniF2F. This will be fixed in the future

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01090 2023-12-19 cs.AI cs.CL 88%

Self Generated Wargame AI: Double Layer Agent Task Planning Based on Large Language Model

Y. Sun, J. Zhao, C. Yu, W. Wang, X. Zhou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09241 2023-12-15 cs.LG cs.CL 88%

TinyGSM: achieving >80% on GSM8k with small language models

Bingbin Liu, Sebastien Bubeck, Ronen Eldan, Janardhan Kulkarni, Yuanzhi Li, Anh Nguyen, Rachel Ward, Yi Zhang

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11135 2023-11-21 cs.CL cs.AI 88%

A Principled Framework for Knowledge-enhanced Large Language Model

Saizhuo Wang, Zhihan Liu, Zhaoran Wang, Jian Guo

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07582 2023-11-15 cs.CL cs.AI 88%

Evaluating the Potential of Leading Large Language Models in Reasoning Biology Questions

Xinyu Gong, Jason Holmes, Yiwei Li, Zhengliang Liu, Qi Gan, Zihao Wu, Jianli Zhang, Yusong Zou, Yuxi Teng, Tian Jiang, Hongtu Zhu, Wei Liu, Tianming Liu, Yajun Yan

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.03353 2023-11-08 cs.CL cs.AI 88%

MindGames: Targeting Theory of Mind in Large Language Models with Dynamic Epistemic Modal Logic

Damien Sileo, Antoine Lernould

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP Findings 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15269 2023-11-07 cs.CL cs.AI 88%

Testing the General Deductive Reasoning Capacity of Large Language Models Using OOD Examples

Abulhair Saparov, Richard Yuanzhe Pang, Vishakh Padmakumar, Nitish Joshi, Seyed Mehran Kazemi, Najoung Kim, He He

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Published as a conference paper at NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15080 2023-10-27 cs.CL cs.AI 88%

Visually-Situated Natural Language Understanding with Contrastive Reading Model and Frozen Large Language Models

Geewook Kim, Hodong Lee, Daehee Kim, Haeji Jung, Sanghee Park, Yoonsik Kim, Sangdoo Yun, Taeho Kil, Bado Lee, Seunghyun Park

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 22 pages; To appear at EMNLP 2023 Main Conference (Project page: https://naver-ai.github.io/cream )

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12971 2023-10-26 cs.CV cs.AI cs.CL 88%

CLAIR: Evaluating Image Captions with Large Language Models

David Chan, Suzanne Petryk, Joseph E. Gonzalez, Trevor Darrell, John Canny

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments To Appear at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15337 2023-10-25 cs.AI cs.CL cs.CY 88%

Moral Foundations of Large Language Models

Marwa Abdulhai, Gregory Serapio-Garcia, Clément Crepy, Daria Valter, John Canny, Natasha Jaques

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00121 2023-10-19 cs.CL cs.AI cs.CR cs.SE 88%

Getting pwn'd by AI: Penetration Testing with Large Language Models

Andreas Happe, Jürgen Cito

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08840 2023-10-16 cs.CL cs.AI 88%

Large Language Models as Source Planner for Personalized Knowledge-grounded Dialogue

Hongru Wang, Minda Hu, Yang Deng, Rui Wang, Fei Mi, Weichao Wang, Yasheng Wang, Wai-Chung Kwan, Irwin King, Kam-Fai Wong

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07018 2023-10-12 cs.CL cs.AI cs.RO 88%

NEWTON: Are Large Language Models Capable of Physical Reasoning?

Yi Ru Wang, Jiafei Duan, Dieter Fox, Siddhartha Srinivasa

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 Findings; 8 pages, 3 figures, 7 tables; Project page: https://newtonreasoning.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05845 2023-10-10 cs.CL cs.AI 88%

GraphLLM: Boosting Graph Reasoning Ability of Large Language Model

Ziwei Chai, Tianjie Zhang, Liang Wu, Kaiqiao Han, Xiaohai Hu, Xuanwen Huang, Yang Yang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05686 2023-10-10 cs.CL cs.AI 88%

The potential of large language models for improving probability learning: A study on ChatGPT3.5 and first-year computer engineering students

Angel Udias, Antonio Alonso-Ayuso, Ignacio Sanchez, Sonia Hernandez, Maria Eugenia Castellanos, Raquel Montes Diez, Emilio Lopez Cano

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 10 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05157 2023-10-10 cs.CL cs.AI 88%

MenatQA: A New Dataset for Testing the Temporal Comprehension and Reasoning Abilities of Large Language Models

Yifan Wei, Yisong Su, Huanhuan Ma, Xiaoyan Yu, Fangyu Lei, Yuanzhe Zhang, Jun Zhao, Kang Liu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13165 2023-09-26 cs.CL cs.AI 88%

Large Language Models Are Also Good Prototypical Commonsense Reasoners

Chenin Li, Qianglong Chen, Yin Zhang, Yifei Zhang, Hongxiang Yao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03224 2023-09-13 cs.AI cs.LG 88%

No Train Still Gain. Unleash Mathematical Reasoning of Large Language Models with Monte Carlo Tree Search Guided by Energy Function

Haotian Xu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments still in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01868 2023-09-06 cs.CL cs.AI 88%

On the Planning, Search, and Memorization Capabilities of Large Language Models

Yunhao Yang, Anshul Tomar

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 13 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03780 2023-08-31 cs.CL cs.AI 88%

Reliable Natural Language Understanding with Large Language Models and Answer Set Programming

Abhiramon Rajasekharan, Yankai Zeng, Parth Padalkar, Gopal Gupta

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments In Proceedings ICLP 2023, arXiv:2308.14898

Journal ref EPTCS 385, 2023, pp. 274-287

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03296 2023-08-08 cs.LG cs.CL stat.ML 88%

Studying Large Language Model Generalization with Influence Functions

Roger Grosse, Juhan Bae, Cem Anil, Nelson Elhage, Alex Tamkin, Amirhossein Tajdini, Benoit Steiner, Dustin Li, Esin Durmus, Ethan Perez, Evan Hubinger, Kamilė Lukošiūtė, Karina Nguyen, Nicholas Joseph, Sam McCandlish, Jared Kaplan, Samuel R. Bowman

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

Comments 119 pages, 47 figures, 22 tables

详情

展开后加载摘要…

URL PDF HTML 收藏