arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2312.04474 2024-07-31 cs.CL cs.AI cs.LG cs.RO 85%

Chain of Code: Reasoning with a Language Model-Augmented Code Emulator

Chengshu Li, Jacky Liang, Andy Zeng, Xinyun Chen, Karol Hausman, Dorsa Sadigh, Sergey Levine, Li Fei-Fei, Fei Xia, Brian Ichter

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2024 Oral; Project webpage: https://chain-of-code.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15677 2024-07-23 cs.RO 85%

Language models are robotic planners: reframing plans as goal refinement graphs

Ateeq Sharfuddin, Travis Breaux

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments 7 pages, 3 figures, RSS 2024 SemRob Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.13193 2024-07-23 cs.HC 85%

SurrealDriver: Designing LLM-powered Generative Driver Agent Framework based on Human Drivers' Driving-thinking Data

Ye Jin, Ruoxuan Yang, Zhijie Yi, Xiaoxi Shen, Huiling Peng, Xiaoan Liu, Jingli Qin, Jiayang Li, Jintao Xie, Peizhong Gao, Guyue Zhou, Jiangtao Gong

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.07051 2024-07-19 cs.CL cs.AI cs.LG 85%

Language models show human-like content effects on reasoning tasks

Ishita Dasgupta, Andrew K. Lampinen, Stephanie C. Y. Chan, Hannah R. Sheahan, Antonia Creswell, Dharshan Kumaran, James L. McClelland, Felix Hill

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published version of record: https://academic.oup.com/pnasnexus/article/3/7/pgae233/7712372

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02178 2024-07-12 cs.CL cs.AI cs.LG 85%

Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models

Changyu Chen, Xiting Wang, Ting-En Lin, Ang Lv, Yuchuan Wu, Xin Gao, Ji-Rong Wen, Rui Yan, Yongbin Li

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18505 2024-06-27 cs.LG cs.AI cs.CL cs.RO 85%

Mental Modeling of Reinforcement Learning Agents by Language Models

Wenhao Lu, Xufeng Zhao, Josua Spisak, Jae Hee Lee, Stefan Wermter

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments https://lukaswill.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17806 2024-06-27 cs.CL cs.AI cs.CR cs.CV cs.LG 85%

MOSSBench: Is Your Multimodal Language Model Oversensitive to Safe Queries?

Xirui Li, Hengguang Zhou, Ruochen Wang, Tianyi Zhou, Minhao Cheng, Cho-Jui Hsieh

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.18070 2024-06-18 cs.CL cs.AI cs.LG 85%

Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?

Andreas Opedal, Alessandro Stolfo, Haruki Shirakami, Ying Jiao, Ryan Cotterell, Bernhard Schölkopf, Abulhair Saparov, Mrinmaya Sachan

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06610 2024-06-12 cs.CL cs.AI cs.LG 85%

Reinterpreting 'the Company a Word Keeps': Towards Explainable and Ontologically Grounded Language Models

Walid S. Saba

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 12 pages, 4 figures. arXiv admin note: text overlap with arXiv:2308.14199, arXiv:2306.00017

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13212 2024-06-07 cs.CL cs.AI cs.LG 85%

Soft Self-Consistency Improves Language Model Agents

Han Wang, Archiki Prasad, Elias Stengel-Eskin, Mohit Bansal

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2024 Camera-Ready, the first three authors contributed equally; Code: https://github.com/HanNight/soft_self_consistency

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12061 2024-06-06 cs.LG cs.AI cs.CL 85%

All Language Models Large and Small

Zhixun Chen, Yali Du, David Mguni

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19326 2024-05-30 cs.CV cs.GR cs.HC 85%

Reasoning3D -- Grounding and Reasoning in 3D: Fine-Grained Zero-Shot Open-Vocabulary 3D Reasoning Part Segmentation via Large Vision-Language Models

Tianrun Chen, Chunan Yu, Jing Li, Jianqi Zhang, Lanyun Zhu, Deyi Ji, Yong Zhang, Ying Zang, Zejian Li, Lingyun Sun

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18361 2024-05-29 cs.CV 85%

Is a 3D-Tokenized LLM the Key to Reliable Autonomous Driving?

Yifan Bai, Dongming Wu, Yingfei Liu, Fan Jia, Weixin Mao, Ziheng Zhang, Yucheng Zhao, Jianbing Shen, Xing Wei, Tiancai Wang, Xiangyu Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15646 2024-05-27 cs.RO 85%

LLM-based Robot Task Planning with Exceptional Handling for General Purpose Service Robots

Ruoyu Wang, Zhipeng Yang, Zinan Zhao, Xinyan Tong, Zhi Hong, Kun Qian

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12741 2024-05-27 cs.CV 85%

MuLan: Multimodal-LLM Agent for Progressive and Interactive Multi-Object Diffusion

Sen Li, Ruochen Wang, Cho-Jui Hsieh, Minhao Cheng, Tianyi Zhou

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Added the application to human-agent interaction; added discussion with concurrent work

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.04346 2024-05-07 cs.CV 85%

Koala: Key frame-conditioned long video-LLM

Reuben Tan, Ximeng Sun, Ping Hu, Jui-hsien Wang, Hanieh Deilamsalehy, Bryan A. Plummer, Bryan Russell, Kate Saenko

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted at CVPR 2024 as a poster highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02078 2024-04-03 cs.AI cs.CL cs.LG 85%

Advancing LLM Reasoning Generalists with Preference Trees

Lifan Yuan, Ganqu Cui, Hanbin Wang, Ning Ding, Xingyao Wang, Jia Deng, Boji Shan, Huimin Chen, Ruobing Xie, Yankai Lin, Zhenghao Liu, Bowen Zhou, Hao Peng, Zhiyuan Liu, Maosong Sun

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Models and data are available at https://github.com/OpenBMB/Eurus

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10507 2024-03-18 cs.SE 85%

Demystifying Faulty Code with LLM: Step-by-Step Reasoning for Explainable Fault Localization

Ratnadira Widyasari, Jia Wei Ang, Truong Giang Nguyen, Neil Sharma, David Lo

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments To be appeared at 2024 IEEE International Conference on Software Analysis, Evolution and Reengineering (SANER)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02884 2024-03-06 cs.CL cs.AI cs.LG 85%

MathScale: Scaling Instruction Tuning for Mathematical Reasoning

Zhengyang Tang, Xingxing Zhang, Benyou Wang, Furu Wei

专题命中 推理与问题求解 :instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15688 2024-01-31 cs.CV 85%

Divide and Conquer: Language Models can Plan and Self-Correct for Compositional Text-to-Image Generation

Zhenyu Wang, Enze Xie, Aoxue Li, Zhongdao Wang, Xihui Liu, Zhenguo Li

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.09048 2024-01-19 cs.CL cs.AI cs.IR cs.LG cs.SE 85%

CodeKGC: Code Language Model for Generative Knowledge Graph Construction

Zhen Bi, Jing Chen, Yinuo Jiang, Feiyu Xiong, Wei Guo, Huajun Chen, Ningyu Zhang

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACM Transactions on Asian and Low-Resource Language Information Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02412 2024-01-05 cs.LG cs.AI cs.CL cs.CV 85%

LLM Augmented LLMs: Expanding Capabilities through Composition

Rachit Bansal, Bidisha Samanta, Siddharth Dalmia, Nitish Gupta, Shikhar Vashishth, Sriram Ganapathy, Abhishek Bapna, Prateek Jain, Partha Talukdar

专题命中 推理与问题求解 :LLM(title);language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 17 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.13558 2023-12-22 cs.LG cs.AI cs.CL cs.CV 85%

The Truth is in There: Improving Reasoning in Language Models with Layer-Selective Rank Reduction

Pratyusha Sharma, Jordan T. Ash, Dipendra Misra

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06720 2023-12-15 cs.CV 85%

Audio-Visual LLM for Video Understanding

Fangxun Shu, Lei Zhang, Hao Jiang, Cihang Xie

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.05230 2023-12-11 cs.AI cs.CL cs.CV cs.LG cs.RO 85%

Language Models, Agent Models, and World Models: The LAW for Machine Reasoning and Planning

Zhiting Hu, Tianmin Shu

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Position paper. Accompanying NeurIPS2023 Tutorial: https://sites.google.com/view/neurips2023law/home

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15714 2023-11-08 cs.CL cs.AI cs.LG 85%

Explicit Planning Helps Language Models in Logical Reasoning

Hongyu Zhao, Kangrui Wang, Mo Yu, Hongyuan Mei

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023 camera-ready; updated results on PrOntoQA with code bugs fixed

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.05973 2023-11-03 cs.RO cs.AI cs.CL cs.CV cs.LG 85%

VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models

Wenlong Huang, Chen Wang, Ruohan Zhang, Yunzhu Li, Jiajun Wu, Li Fei-Fei

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.10626 2023-10-31 cs.CL cs.AI cs.LG 85%

Language Models Meet World Models: Embodied Experiences Enhance Language Models

Jiannan Xiang, Tianhua Tao, Yi Gu, Tianmin Shu, Zirui Wang, Zichao Yang, Zhiting Hu

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14045 2023-10-17 cs.CL cs.AI cs.LG 85%

The CoT Collection: Improving Zero-shot and Few-shot Learning of Language Models via Chain-of-Thought Fine-Tuning

Seungone Kim, Se June Joo, Doyoung Kim, Joel Jang, Seonghyeon Ye, Jamin Shin, Minjoon Seo

专题命中 推理与问题求解 :language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07622 2023-10-10 cs.CL cs.AI cs.LG 85%

Human-Like Intuitive Behavior and Reasoning Biases Emerged in Language Models -- and Disappeared in GPT-4

Thilo Hagendorff, Sarah Fabi

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Overlap with arXiv:2212.05206

详情

展开后加载摘要…

URL PDF HTML 收藏