arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 19038 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 19038 篇

2412.19595 2024-12-30 cs.RO cs.AI 81%

SocRATES: Towards Automated Scenario-based Testing of Social Navigation Algorithms

Shashank Rao Marpally, Pranav Goyal, Harold Soh

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21791 2024-10-30 cs.CL 81%

Enhancing Adversarial Attacks through Chain of Thought

Jingbo Su

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12997 2024-10-18 cs.CL 81%

"Let's Argue Both Sides": Argument Generation Can Force Small Models to Utilize Previously Inaccessible Reasoning Capabilities

Kaveh Eskandari Miandoab, Vasanth Sarathy

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);foundation model(abstract);prompting(abstract)

Comments Accepted to Workshop on Customizable NLP: Progress and Challenges in Customizing NLP for a Domain, Application, Group, or Individual at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12934 2024-10-18 cs.CL 81%

Enhancing Mathematical Reasoning in LLMs by Stepwise Correction

Zhenyu Wu, Qingkai Zeng, Zhihan Zhang, Zhaoxuan Tan, Chao Shen, Meng Jiang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12452 2024-10-07 cs.CL 81%

Unlocking Reasoning Potential in Large Langauge Models by Scaling Code-form Planning

Jiaxin Wen, Jian Guan, Hongning Wang, Wei Wu, Minlie Huang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19603 2024-10-01 cs.CV cs.AI 81%

One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos

Zechen Bai, Tong He, Haiyang Mei, Pichao Wang, Ziteng Gao, Joya Chen, Lei Liu, Zheng Zhang, Mike Zheng Shou

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted by NeurlPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.17457 2024-09-27 cs.CV cs.AI 81%

CadVLM: Bridging Language and Vision in the Generation of Parametric CAD Sketches

Sifan Wu, Amir Khasahmadi, Mor Katz, Pradeep Kumar Jayaraman, Yewen Pu, Karl Willis, Bang Liu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14306 2024-09-24 cs.AI 81%

LLMs are One-Shot URL Classifiers and Explainers

Fariza Rashid, Nishavi Ranaweera, Ben Doyle, Suranga Seneviratne

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05001 2024-09-10 cs.SE cs.AI 81%

A Pair Programming Framework for Code Generation via Multi-Plan Exploration and Feedback-Driven Refinement

Huan Zhang, Wei Cheng, Yuhan Wu, Wei Hu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted in the 39th IEEE/ACM International Conference on Automated Software Engineering (ASE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20563 2024-07-31 cs.CV cs.AI 81%

Pyramid Coder: Hierarchical Code Generator for Compositional Visual Question Answering

Ruoyue Shen, Nakamasa Inoue, Koichi Shinoda

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to the IEEE International Conference on Image Processing (IEEE ICIP) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12498 2024-07-18 cs.CL cs.CV 81%

Evaluating Linguistic Capabilities of Multimodal LLMs in the Lens of Few-Shot Learning

Mustafa Dogan, Ilker Kesen, Iacer Calixto, Aykut Erdem, Erkut Erdem

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);pretraining(abstract);prompting(abstract)

Comments Preprint. 33 pages, 17 Figures, 3 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00782 2024-07-16 cs.CL 81%

Step-Controlled DPO: Leveraging Stepwise Error for Enhanced Mathematical Reasoning

Zimu Lu, Aojun Zhou, Ke Wang, Houxing Ren, Weikang Shi, Junting Pan, Mingjie Zhan, Hongsheng Li

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00209 2024-07-09 cs.CL 81%

EventGround: Narrative Reasoning by Grounding to Eventuality-centric Knowledge Graphs

Cheng Jiayang, Lin Qiu, Chunkit Chan, Xin Liu, Yangqiu Song, Zheng Zhang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18357 2024-06-12 cs.CL 81%

Faithful Logical Reasoning via Symbolic Chain-of-Thought

Jundong Xu, Hao Fei, Liangming Pan, Qian Liu, Mong-Li Lee, Wynne Hsu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by ACL 2024 (main proceeding)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.06932 2024-06-07 cs.CL 81%

ERA-CoT: Improving Chain-of-Thought through Entity Relationship Analysis

Yanming Liu, Xinyue Peng, Tianyu Du, Jianwei Yin, Weihao Liu, Xuhong Zhang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 15 pages, second version of ERA-CoT

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19444 2024-05-31 cs.AI 81%

MathChat: Benchmarking Mathematical Reasoning and Instruction Following in Multi-Turn Interactions

Zhenwen Liang, Dian Yu, Wenhao Yu, Wenlin Yao, Zhihan Zhang, Xiangliang Zhang, Dong Yu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07099 2024-05-24 cs.CL 81%

Controllable Data Augmentation for Few-Shot Text Mining with Chain-of-Thought Attribute Manipulation

Letian Peng, Yuwei Zhang, Jingbo Shang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01359 2024-05-03 cs.CL physics.acc-ph 81%

GAIA: A General AI Assistant for Intelligent Accelerator Operations

Frank Mayet

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19857 2024-04-01 cs.AI 81%

LLMSense: Harnessing LLMs for High-level Reasoning Over Spatiotemporal Sensor Traces

Xiaomin Ouyang, Mani Srivastava

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.16049 2024-03-26 cs.CL 81%

MuSR: Testing the Limits of Chain-of-thought with Multistep Soft Reasoning

Zayne Sprague, Xi Ye, Kaj Bostrom, Swarat Chaudhuri, Greg Durrett

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Journal ref ICLR 2024 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01135 2024-02-05 cs.IR cs.CL 81%

A Multi-Agent Conversational Recommender System

Jiabao Fang, Shen Gao, Pengjie Ren, Xiuying Chen, Suzan Verberne, Zhaochun Ren

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20256 2023-11-07 cs.CL 81%

PsyCoT: Psychological Questionnaire as Powerful Chain-of-Thought for Personality Detection

Tao Yang, Tianyuan Shi, Fanqi Wan, Xiaojun Quan, Qifan Wang, Bingzhe Wu, Jiaxiang Wu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00656 2023-10-30 cs.AI 81%

LEGO-Prover: Neural Theorem Proving with Growing Libraries

Haiming Wang, Huajian Xin, Chuanyang Zheng, Lin Li, Zhengying Liu, Qingxing Cao, Yinya Huang, Jing Xiong, Han Shi, Enze Xie, Jian Yin, Zhenguo Li, Heng Liao, Xiaodan Liang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.14868 2023-10-24 cs.CL 81%

Assessing Step-by-Step Reasoning against Lexical Negation: A Case Study on Syllogism

Mengyu Ye, Tatsuki Kuribayashi, Jun Suzuki, Goro Kobayashi, Hiroaki Funayama

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10035 2023-10-17 cs.CL 81%

Empirical Study of Zero-Shot NER with ChatGPT

Tingyu Xie, Qi Li, Jian Zhang, Yan Zhang, Zuozhu Liu, Hongwei Wang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted to EMNLP 2023 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.10509 2023-06-26 cs.CL 81%

Interleaving Retrieval with Chain-of-Thought Reasoning for Knowledge-Intensive Multi-Step Questions

Harsh Trivedi, Niranjan Balasubramanian, Tushar Khot, Ashish Sabharwal

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments ACL'23 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01191 2026-05-12 cs.AI cs.CL cs.LG 81%

Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens

大语言模型的链式推理是否是一种幻象?一种数据分布视角

Chengshuai Zhao, Zhen Tan, Pingchuan Ma, Dawei Li, Bohan Jiang, Yancheng Wang, Yingzhen Yang, Huan Liu

机构 * Arizona State University(亚利桑那州立大学)

专题命中 推理与问题求解 :language model(abstract,comments);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过数据分布视角探讨了大语言模型链式推理的有效性,揭示其在分布差异下的脆弱性,提出DataAlchemy环境验证了推理能力受训练分布影响的结论。

Comments Accepted by the Association for Computational Linguistics (ACL) 2026 and Foundations of Reasoning in Language Models (FoRLM) at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22037 2025-12-05 cs.CY 81%

What AI Speaks for Your Community: Polling AI Agents for Public Opinion on Data Center Projects

人工智能为你的社区发声:通过AI代理收集数据中心项目公众意见

Zhifeng Wu, Yuelin Han, Shaolei Ren

专题命中 推理与问题求解 :foundation model(abstract,comments);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出AI代理调查框架,利用大型语言模型评估社区对数据中心项目的意见,以指导负责任的AI发展。

Comments 35 Pages. Accepted to NeurIPS 2025 Workshop on Socially Responsible and Trustworthy Foundation Models (ResponsibleFM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12014 2024-07-15 cs.CL cs.AI cs.LG 81%

EnvGen: Generating and Adapting Environments via LLMs for Training Embodied Agents

Abhay Zala, Jaemin Cho, Han Lin, Jaehong Yoon, Mohit Bansal

专题命中 推理与问题求解 :LLM(abstract,comments);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments COLM 2024; First two authors contributed equally; Project website: https://envgen-llm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25160 2026-08-28 cs.CV cs.AI cs.CL 版本更新 81%

GSM8K-V: Can Vision Language Models Solve Grade School Math Word Problems in Visual Contexts

GSM8K-V:视觉语言模型能否在视觉语境下解决小学级数学应用题

Fan Yuan, Yuchen Yan, Yifan Jiang, Haoran Zhao, Tao Feng, Jinyan Chen, Yanwei Lou, Wenqi Zhang, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究构建了多图像视觉数学基准GSM8K-V,评估34个VLMs发现其存在显著模态差距,最优模型仅达59%准确率,瓶颈为隐式视觉推理错误,且视觉数学优化模型在此无提升。

Comments 59 pages, 7 figures, Project Page: https://zju-real.github.io/GSM8K-V Code: https://github.com/ZJU-REAL/GSM8K-V Datasets: https://huggingface.co/datasets/ZJU-REAL/GSM8K-V Accepted at EMNLP 2026 Main Conference. Updated to the camera-ready version with additional experiments, analyses, and revisions

详情

展开后加载摘要…

URL PDF HTML 收藏