arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18875 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18875 篇

2403.16097 2024-03-29 cs.AI cs.LO cs.SE 85%

Can Language Models Pretend Solvers? Logic Code Simulation with LLMs

Minyu Chen, Guoqiang Li, Ling-I Wu, Ruibang Liu, Yuxin Su, Xi Chang, Jianxin Xue

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments 12 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10670 2024-03-26 cs.CL cs.RO 85%

OpenFMNav: Towards Open-Set Zero-Shot Object Navigation via Vision-Language Foundation Models

Yuxuan Kuang, Hai Lin, Meng Jiang

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07702 2024-03-15 cs.CL 85%

Better Zero-Shot Reasoning with Role-Play Prompting

Aobo Kong, Shiwan Zhao, Hao Chen, Qicheng Li, Yong Qin, Ruiqi Sun, Xin Zhou, Enzhi Wang, Xiaohang Dong

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments NAACL 2024, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11725 2024-03-13 cs.CL 85%

Speak It Out: Solving Symbol-Related Problems with Symbol-to-Language Conversion for Language Models

Yile Wang, Sijie Cheng, Zixin Sun, Peng Li, Yang Liu

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL

Comments ICLR AGI Workshop 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01651 2024-02-06 cs.CY cs.AI 85%

Informed AI Regulation: Comparing the Ethical Frameworks of Leading LLM Chatbots Using an Ethics-Based Audit to Assess Moral Reasoning and Normative Values

Jon Chun, Katherine Elkins

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 23 pages, 6 figures (3 as tables), 1 table (in LaTeX)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05384 2024-01-12 math.HO cs.AI 85%

From Good to Great: Improving Math Reasoning with Tool-Augmented Interleaf Prompting

Nuo Chen, Hongguang Li, Baoyuan Wang, Jia Li

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00125 2024-01-02 cs.AI cs.CV 85%

LLM-Assist: Enhancing Closed-Loop Planning with Language-Based Reasoning

S P Sharan, Francesco Pittaluga, Vijay Kumar B G, Manmohan Chandraker

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 15 pages, 8 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17016 2023-12-29 cs.CV cs.AI 85%

On the Promises and Challenges of Multimodal Foundation Models for Geographical, Environmental, Agricultural, and Urban Planning Applications

Chenjiao Tan, Qian Cao, Yiwei Li, Jielu Zhang, Xiao Yang, Huaqin Zhao, Zihao Wu, Zhengliang Liu, Hao Yang, Nemin Wu, Tao Tang, Xinyue Ye, Lilong Chai, Ninghao Liu, Changying Li, Lan Mu, Tianming Liu, Gengchen Mai

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 110 Pages; 61 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10003 2023-12-18 cs.CL 85%

ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent

Renat Aksitov, Sobhan Miryoosefi, Zonglin Li, Daliang Li, Sheila Babayan, Kavya Kopparapu, Zachary Fisher, Ruiqi Guo, Sushant Prakash, Pranesh Srinivasan, Manzil Zaheer, Felix Yu, Sanjiv Kumar

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 19 pages, 4 figures, 4 tables, 8 listings

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18512 2023-11-02 cs.LG 85%

Preventing Language Models From Hiding Their Reasoning

Fabien Roger, Ryan Greenblatt

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

Comments Edit: Fix typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14215 2023-10-30 cs.CL 85%

Exploring Chain-of-Thought Style Prompting for Text-to-SQL

Chang-You Tai, Ziru Chen, Tianshu Zhang, Xiang Deng, Huan Sun

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2023 main; long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08740 2023-10-24 cs.CL cs.SY eess.SY 85%

A Zero-Shot Language Agent for Computer Control with Structured Reflection

Tao Li, Gang Li, Zhiwei Deng, Bryan Wang, Yang Li

专题命中 推理与问题求解 :language agent(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10698 2023-10-24 cs.CL 85%

Bridging Code Semantic and LLMs: Semantic Chain-of-Thought Prompting for Code Generation

Yingwei Ma, Yue Yu, Shanshan Li, Yu Jiang, Yong Guo, Yuanliang Zhang, Yutao Xie, Xiangke Liao

专题命中 推理与问题求解 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments There may be calculation errors in Table 4 of the paper. We need time to verify and supplement, so the manuscript needs to be withdrawn. Thanks!

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07004 2023-10-24 cs.CL 85%

Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting

Haoyang Huang, Tianyi Tang, Dongdong Zhang, Wayne Xin Zhao, Ting Song, Yan Xia, Furu Wei

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13160 2023-10-11 cs.CL 85%

Can ChatGPT Defend its Belief in Truth? Evaluating LLM Reasoning via Debate

Boshi Wang, Xiang Yue, Huan Sun

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP-23 (findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03659 2023-10-06 cs.AI cs.MA cs.SE 85%

Balancing Autonomy and Alignment: A Multi-Dimensional Taxonomy for Autonomous LLM-powered Multi-Agent Architectures

Thorsten Händler

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05653 2023-10-04 cs.CL 85%

MAmmoTH: Building Math Generalist Models through Hybrid Instruction Tuning

Xiang Yue, Xingwei Qu, Ge Zhang, Yao Fu, Wenhao Huang, Huan Sun, Yu Su, Wenhu Chen

专题命中 推理与问题求解 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Work in progress; Xiang Yue and Wenhu Chen contributed equally to this paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.08286 2023-10-02 cs.CL 85%

ALERT: Adapting Language Models to Reasoning Tasks

Ping Yu, Tianlu Wang, Olga Golovneva, Badr AlKhamissi, Siddharth Verma, Zhijing Jin, Gargi Ghosh, Mona Diab, Asli Celikyilmaz

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06719 2023-09-14 cs.AI cs.HC 85%

TrafficGPT: Viewing, Processing and Interacting with Traffic Foundation Models

Siyao Zhang, Daocheng Fu, Zhao Zhang, Bin Yu, Pinlong Cai

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06599 2023-09-08 cs.SE cs.CL 85%

Structured Chain-of-Thought Prompting for Code Generation

Jia Li, Ge Li, Yongmin Li, Zhi Jin

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments arXiv admin note: text overlap with arXiv:2303.17780

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14972 2023-08-30 cs.RO cs.AI 85%

LLM-Based Human-Robot Collaboration Framework for Manipulation Tasks

Haokun Liu, Yaonan Zhu, Kenji Kato, Izumi Kondo, Tadayoshi Aoyama, Yasuhisa Hasegawa

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments IEEE MHS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06391 2023-08-15 cs.CL cs.RO 85%

Dynamic Planning with a LLM

Gautier Dagan, Frank Keller, Alex Lascarides

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05960 2023-08-14 cs.AI 85%

BOLAA: Benchmarking and Orchestrating LLM-augmented Autonomous Agents

Zhiwei Liu, Weiran Yao, Jianguo Zhang, Le Xue, Shelby Heinecke, Rithesh Murthy, Yihao Feng, Zeyuan Chen, Juan Carlos Niebles, Devansh Arpit, Ran Xu, Phil Mui, Huan Wang, Caiming Xiong, Silvio Savarese

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.13911 2023-07-03 cs.AI 85%

Federated Prompting and Chain-of-Thought Reasoning for Improving LLMs Answering

Xiangyang Liu, Tianqi Pang, Chenyou Fan

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18170 2023-06-12 cs.CL 85%

Leveraging Training Data in Few-Shot Prompting for Numerical Reasoning

Zhanming Jie, Wei Lu

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07716 2023-05-16 cs.RO cs.AI 85%

Learning to Reason over Scene Graphs: A Case Study of Finetuning GPT-2 into a Robot Language Model for Grounded Task Planning

Georgia Chalvatzaki, Ali Younes, Daljeet Nandha, An Le, Leonardo F. R. Ribeiro, Iryna Gurevych

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.01795 2023-05-04 cs.CL 85%

Multimodal Procedural Planning via Dual Text-Image Prompting

Yujie Lu, Pan Lu, Zhiyu Chen, Wanrong Zhu, Xin Eric Wang, William Yang Wang

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.01771 2023-04-05 cs.AI 85%

Using Language Models For Knowledge Acquisition in Natural Language Reasoning Problems

Fangzhen Lin, Ziyi Shou, Chengcai Chen

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.14045 2023-03-02 cs.CL cs.CV 85%

Language Is Not All You Need: Aligning Perception with Language Models

Shaohan Huang, Li Dong, Wenhui Wang, Yaru Hao, Saksham Singhal, Shuming Ma, Tengchao Lv, Lei Cui, Owais Khan Mohammed, Barun Patra, Qiang Liu, Kriti Aggarwal, Zewen Chi, Johan Bjorck, Vishrav Chaudhary, Subhojit Som, Xia Song, Furu Wei

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28919 2026-05-29 cs.LG cs.AI cs.CL 85%

CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Language Models

CosmicFish-HRM:紧凑语言模型中基于层次循环机制的适应性推理

Venkat Akhil Lakkapragada

机构 * Mistyoz AI Hyderabad, India(Mistyoz AI 德里, 印度)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出一种紧凑语言模型CosmicFish-HRM,通过层次推理模块动态分配推理深度,在保持较小参数量的同时实现适应性推理。

Comments 17 pages, 4 figures. Exploratory study of adaptive reasoning depth in compact autoregressive language models. Code available at https://github.com/MistyozAI/CosmicFish-HRM

详情

展开后加载摘要…

URL PDF HTML 收藏