arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18936 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18936 篇

2510.22251 2025-10-28 cs.CL cs.AI cs.LG 85%

You Don't Need Prompt Engineering Anymore: The Prompting Inversion

Imran Khan

机构 * Independent Researcher(独立研究者)

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 17 pages, 1 figure, 6 tables. Code and experimental data available at https://github.com/strongSoda/prompt-sculpting

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19487 2025-10-24 cs.MA 85%

Evolution of Cooperation in LLM-Agent Societies: A Preliminary Study Using Different Punishment Strategies

Kavindu Warnakulasuriya, Prabhash Dissanayake, Navindu De Silva, Stephen Cranefield, Bastin Tony Roy Savarimuthu, Surangika Ranathunga, Nisansa de Silva

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 20 pages, 10 figures, Accepted for presentation as a full paper at the COINE 2025 workshop at AAMAS 2025 (https://coin-workshop.github.io/coine-2025-detroit/accepted_for_presentation.html)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19767 2025-10-23 cs.CL cs.AI cs.LG 85%

SmartSwitch: Advancing LLM Reasoning by Overcoming Underthinking via Promoting Deeper Thought Exploration

Xichen Zhang, Sitong Wu, Haoru Tan, Shaozuo Yu, Yinghao Zhu, Ziyi He, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Code: https://github.com/dvlab-research/SmartSwitch

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18179 2025-10-23 cs.MA 85%

Adaptive Coopetition: Leveraging Coarse Verifier Signals for Resilient Multi-Agent LLM Reasoning

Rui Jerry Huang, Wendy Liu, Anastasia Miin, Lei Ding

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 13 pages, 8 figures. Accepted for presentation at the 5th Workshop on Mathematical Reasoning and AI at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18364 2025-10-22 cs.IR cs.SE 85%

Evaluating LLM-Based Mobile App Recommendations: An Empirical Study

Quim Motger, Xavier Franch, Vincenzo Gervasi, Jordi Marco

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18327 2025-10-22 cs.SE 85%

InspectCoder: Dynamic Analysis-Enabled Self Repair through interactive LLM-Debugger Collaboration

Yunkun Wang, Yue Zhang, Guochang Li, Chen Zhi, Binhua Li, Fei Huang, Yongbin Li, Shuiguang Deng

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16767 2025-10-21 cs.RO 85%

T3 Planner: A Self-Correcting LLM Framework for Robotic Motion Planning with Temporal Logic

Jia Li, Guoxiang Zhao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01005 2025-10-21 cs.CL cs.AI cs.LG 85%

When To Solve, When To Verify: Compute-Optimal Problem Solving and Generative Verification for LLM Reasoning

Nishad Singhi, Hritik Bansal, Arian Hosseini, Aditya Grover, Kai-Wei Chang, Marcus Rohrbach, Anna Rohrbach

机构 * TU Darmstadt(图恩-达姆施塔特技术大学) UCLA(加州大学洛杉矶分校) Google Deepmind(谷歌DeepMind) Mila(蒙特利尔人工智能研究院)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16366 2025-10-21 cs.CY 85%

Integrating LLM and Diffusion-Based Agents for Social Simulation

Xinyi Li, Zhiqiang Guo, Qinglang Guo, Hao Jin, Weizhi Ma, Min Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 10 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12997 2025-10-21 cs.LG cs.AI cs.CL 85%

Max It or Miss It: Benchmarking LLM On Solving Extremal Problems

Binxin Gao, Jingjun Han

机构 * University of Maryland(马里兰大学) Fudan University(复旦大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Our benchmark dataset is available at https://huggingface.co/datasets/binxingao/extrem-bench

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12535 2025-10-21 cs.CL cs.AI cs.LG 85%

CorrSteer: Generation-Time LLM Steering via Correlated Sparse Autoencoder Features

Seonglae Cho, Zekun Wu, Adriano Koshiyama

机构 * University College London(伦敦大学学院)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 42 pages, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11278 2025-10-17 cs.LG cs.AI cs.CL 85%

ENIGMA: The Geometry of Reasoning and Alignment in Large-Language Models

Gareth Seneque, Lap-Hang Ho, Nafise Erfanian Saeedi, Jeffrey Molendijk, Ariel Kuperman, Tim Elson

机构 * Australian Broadcasting Corporation(澳大利亚广播公司)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 52 pages, 10 figures, author typo corrected, abstract typo corrected

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11034 2025-10-13 cs.LG cs.AI cs.CL 85%

CausalVLBench: Benchmarking Visual Causal Reasoning in Large Vision-Language Models

Aneesh Komanduri, Karuna Bhaila, Xintao Wu

机构 * Department of Electrical Engineering and Computer Science University of Arkansas(电气工程与计算机科学系 奎萨克大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP 2025 Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08481 2025-10-10 cs.SI 85%

Forecasting the Buzz: Enriching Hashtag Popularity Prediction with LLM Reasoning

Yifei Xu, Jiaying Wu, Herun Wan, Yang Li, Zhen Hou, Min-Yen Kan

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted to CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15849 2025-10-01 cs.CL cs.AI cs.LG 85%

The Impact of Language Mixing on Bilingual LLM Reasoning

Yihao Li, Jiayi Xin, Miranda Muqing Miao, Qi Long, Lyle Ungar

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23674 2025-09-30 cs.AR 85%

AssertGen: Enhancement of LLM-aided Assertion Generation through Cross-Layer Signal Bridging

Hongqin Lyu, Yonghao Wang, Yunlin Du, Mingyu Shi, Zhiteng Chao, Wenxing Li, Tiancheng Wang, Huawei Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15213 2025-09-30 cs.CR 85%

Evil Vizier: Vulnerabilities of LLM-Integrated XR Systems

Yicheng Zhang, Zijian Huang, Sophie Chen, Erfan Shayegani, Jiasi Chen, Nael Abu-Ghazaleh

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15809 2025-09-26 cs.CV 85%

MMaDA: Multimodal Large Diffusion Language Models

Ling Yang, Ye Tian, Bowen Li, Xinchen Zhang, Ke Shen, Yunhai Tong, Mengdi Wang

机构 * Princeton University(普林斯顿大学) Peking University(北京大学) Tsinghua University(清华大学) ByteDance Seed(字节跳动种子)

专题命中 推理与问题求解 :language model(title);foundation model(abstract);pretraining(abstract);post-training(abstract)

Comments NeurIPS 2025. Project: https://github.com/Gen-Verse/MMaDA

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10697 2025-09-25 cs.NE 85%

Language Model Evolutionary Algorithms for Recommender Systems: Benchmarks and Algorithm Comparisons

Jiao Liu, Zhu Sun, Shanshan Feng, Caishun Chen, Yew-Soon Ong

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13329 2025-09-24 cs.CL cs.AI cs.LG 85%

Language Models Can Predict Their Own Behavior

Dhananjay Ashok, Jonathan May

机构 * Information Sciences Institute(信息科学研究所) University of Southern California(南加州大学)

专题命中 推理与问题求解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Presented at the Thirty-Ninth Annual Conference on Neural Information Processing Systems (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18761 2025-09-23 cs.CL cs.AI cs.LG 85%

How Is LLM Reasoning Distracted by Irrelevant Context? An Analysis Using a Controlled Benchmark

Minglai Yang, Ethan Huang, Liang Zhang, Mihai Surdeanu, William Wang, Liangming Pan

机构 * University of Arizona(亚利桑那大学) MOE Key Lab of Computational Linguistics, Peking University(北京大学计算语言学国家重点实验室) University of California, Santa Barbara(加州大学圣巴巴拉分校)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 19 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16970 2025-09-23 cs.CV 85%

LLM-Assisted Semantic Guidance for Sparsely Annotated Remote Sensing Object Detection

Wei Liao, Chunyan Xu, Chenxu Wang, Zhen Cui

机构 * Nanjing University of Science and Technology(南京理工大学) Beijing Normal University(北京师范大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20936 2025-09-23 cs.LG cs.AI cs.CL 85%

Dissecting Persona-Driven Reasoning in Language Models via Activation Patching

Ansh Poonia, Maeghal Jain

机构 * Independent(独立研究者)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP (Findings) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12638 2025-09-17 cs.CE 85%

FinSentLLM: Multi-LLM and Structured Semantic Signals for Enhanced Financial Sentiment Forecasting

Zijian Zhang, Rong Fu, Yangfan He, Xinze Shen, Yanlong Wang, Xiaojing Du, Haochen You, Jiazhao Shi, Simon Fong

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16654 2025-09-11 cs.CV 85%

MSNav: Zero-Shot Vision-and-Language Navigation with Dynamic Memory and LLM Spatial Reasoning

Chenghao Liu, Zhimu Zhou, Jiachen Zhang, Minghao Zhang, Songfang Huang, Huiling Duan

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15302 2025-09-10 cs.AI cs.CL cs.LG 85%

Understanding the Language Model to Solve the Symbolic Multi-Step Reasoning Problem from the Perspective of Buffer Mechanism

Zhiwei Wang, Yunji Wang, Zhongwang Zhang, Zhangchen Zhou, Hui Jin, Tianyang Hu, Jiacheng Sun, Zhenguo Li, Yaoyu Zhang, Zhi-Qin John Xu

机构 * Institute of Natural Sciences, MOE-LSC, Shanghai Jiao Tong University(上海交通大学自然科学院) School of Mathematical Sciences, Shanghai Jiao Tong University(上海交通大学数学学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Huawei Noah’s Ark Lab(华为诺亚实验室) Key Laboratory of Marine Intelligent Equipment and System, Ministry of Education(教育部海洋智能装备与系统重点实验室)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16022 2025-09-04 cs.CL cs.AI cs.LG 85%

NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning

Wei Liu, Siya Qi, Xinyu Wang, Chen Qian, Yali Du, Yulan He

机构 * King’s College London(伦敦国王学院) The Alan Turing Institute(艾伦·图灵研究所) Shanghai Jiao Tong University(上海交通大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 20 pages, 5 tables, 12 figures. accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02324 2025-09-03 cs.RO 85%

Language-Guided Long Horizon Manipulation with LLM-based Planning and Visual Perception

Changshi Zhou, Haichuan Xu, Ningquan Gu, Zhipeng Wang, Bin Cheng, Pengpeng Zhang, Yanchao Dong, Mitsuhiro Hayashibe, Yanmin Zhou, Bin He

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03275 2025-09-03 cs.CL cs.AI cs.LG cs.LO 85%

Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning

DiJia Su, Hanlin Zhu, Yingchen Xu, Jiantao Jiao, Yuandong Tian, Qinqing Zheng

机构 * Meta AI

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20444 2025-08-29 cs.CR 85%

Ransomware 3.0: Self-Composing and LLM-Orchestrated

Md Raz, Meet Udeshi, P. V. Sai Charan, Prashanth Krishnamurthy, Farshad Khorrami, Ramesh Karri

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏