arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18998 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18998 篇

2401.04157 2024-02-21 cs.RO 82%

RePLan: Robotic Replanning with Perception and Language Models

Marta Skreta, Zihan Zhou, Jia Lin Yuan, Kourosh Darvish, Alán Aspuru-Guzik, Animesh Garg

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.15450 2023-12-27 cs.IR 82%

Agent4Ranking: Semantic Robust Ranking via Personalized Query Rewriting Using Multi-agent LLM

Xiaopeng Li, Lixin Su, Pengyue Jia, Xiangyu Zhao, Suqi Cheng, Junfeng Wang, Dawei Yin

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09237 2023-12-15 cs.CV 82%

Pixel Aligned Language Models

Jiarui Xu, Xingyi Zhou, Shen Yan, Xiuye Gu, Anurag Arnab, Chen Sun, Xiaolong Wang, Cordelia Schmid

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

Comments Project page: https://jerryxu.net/PixelLLM

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08912 2023-12-14 cs.CV cs.MM 82%

Delving into Multimodal Prompting for Fine-grained Visual Classification

Xin Jiang, Hao Tang, Junyao Gao, Xiaoyu Du, Shengfeng He, Zechao Li

专题命中 推理与问题求解 :prompting(title,abstract);language model(abstract)

Comments This paper is accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16465 2023-11-29 cs.CV 82%

TextDiffuser-2: Unleashing the Power of Language Models for Text Rendering

Jingye Chen, Yupan Huang, Tengchao Lv, Lei Cui, Qifeng Chen, Furu Wei

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.18804 2023-10-31 cs.CL cs.AI cs.CV cs.LG 82%

Open Visual Knowledge Extraction via Relation-Oriented Multimodality Model Prompting

Hejie Cui, Xinyu Fang, Zihan Zhang, Ran Xu, Xuan Kan, Xin Liu, Yue Yu, Manling Li, Yangqiu Song, Carl Yang

专题命中 推理与问题求解 :prompting(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09139 2023-10-16 cs.GT cs.AI cs.CL cs.LG 82%

The Consensus Game: Language Model Generation via Equilibrium Search

Athul Paul Jacob, Yikang Shen, Gabriele Farina, Jacob Andreas

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10309 2023-09-22 cs.RO 82%

Bridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill

Wenzhe Cai, Siyuan Huang, Guangran Cheng, Yuxing Long, Peng Gao, Changyin Sun, Hao Dong

专题命中 推理与问题求解 :foundation model(title,abstract);LLM(abstract)

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.02721 2023-09-08 cs.RO cs.HC 82%

Gesture-Informed Robot Assistance via Foundation Models

Li-Heng Lin, Yuchen Cui, Yilun Hao, Fei Xia, Dorsa Sadigh

专题命中 推理与问题求解 :foundation model(title);large language model(abstract);language model(abstract)

Comments CoRL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08767 2023-07-19 cs.CL cs.AI cs.LG 82%

A mixed policy to improve performance of language models on math problems

Gang Chen

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.00465 2023-07-18 cs.AI cs.CL cs.LG cs.RO 82%

On Grounded Planning for Embodied Tasks with Language Models

Bill Yuchen Lin, Chengsong Huang, Qian Liu, Wenda Gu, Sam Sommerer, Xiang Ren

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to AAAI 2023 Project website: https://yuchenlin.xyz/g-planet/

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16545 2023-06-30 cs.CV 82%

Palm: Predicting Actions through Language Models @ Ego4D Long-Term Action Anticipation Challenge 2023

Daoji Huang, Otmar Hilliges, Luc Van Gool, Xi Wang

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17626 2023-06-06 cs.AI cs.CL cs.LG 82%

In-Context Analogical Reasoning with Pre-Trained Language Models

Xiaoyang Hu, Shane Storks, Richard L. Lewis, Joyce Chai

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.09031 2023-03-17 cs.CL cs.AI cs.LG 82%

A Picture is Worth a Thousand Words: Language Models Plan from Pixels

Anthony Z. Liu, Lajanugen Logeswaran, Sungryull Sohn, Honglak Lee

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.02098 2022-11-07 cs.CL cs.AI cs.LG 82%

Overcoming Barriers to Skill Injection in Language Modeling: Case Study in Arithmetic

Mandar Sharma, Nikhil Muralidhar, Naren Ramakrishnan

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2022: Math-AI Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.12530 2022-10-25 cs.LG cs.AI cs.CL 82%

LMPriors: Pre-Trained Language Models as Task-Specific Priors

Kristy Choi, Chris Cundy, Sanjari Srivastava, Stefano Ermon

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments First two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.03393 2020-09-09 cs.LG cs.AI cs.CL stat.ML 82%

Generative Language Modeling for Automated Theorem Proving

Stanislas Polu, Ilya Sutskever

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 15+5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11840 2026-07-09 cs.LG cs.AI cs.CY cs.MA 版本更新 82%

Diversity Without Fidelity: A Solver-Sampler Mismatch in Multi-Agent LLM Negotiation Simulation

当推理模型损害行为模拟:多智能体大语言模型谈判中的求解器-采样器不匹配

Sandro Andric

专题命中 推理与问题求解 :LLM(title,comments);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究指出推理增强模型在模拟行为时可能表现不佳,通过三个多智能体谈判环境实验发现,有界推理能产生更多样且妥协导向的轨迹,强调模拟应将模型视为采样器而非求解器。

Comments 20 pages, 2 figures. Substantially revised. Formerly titled "When Reasoning Models Hurt Behavioral Simulation: A Solver-Sampler Mismatch in Multi-Agent LLM Negotiation"

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02113 2026-06-02 cs.CL cs.AI 82%

A Primer in Post-Training Reasoning Data: What We Know About How It Works

后训练推理数据入门:我们对其运作机制的了解

Yaoming Li, Guangxiang Zhao, Qilong Shi, Lin Sun, Xiangzheng Zhang, Tong Yang

专题命中 推理与问题求解 :post-training(title,abstract);分类 cs.CL、cs.AI;LLM(comments)

AI总结 本文综述了后训练推理数据的类型、效用、构建方法和扩展规律,为未来推理数据发布和后训练方案提供归因框架。

Comments 22 pages. Project Repository: https://github.com/RenBing-Sumeru/Awesome-LLM-Reasoning-Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02147 2026-01-06 cs.CV cs.AI cs.LG 82%

BiPrompt: Bilateral Prompt Optimization for Visual and Textual Debiasing in Vision-Language Models

BiPrompt:面向视觉与文本去偏的双重视觉语言模型双向提示优化

Sunny Gupta, Shounak Das, Amit Sethi

专题命中 推理与问题求解 :language model(title);foundation model(abstract,comments);分类 cs.AI、cs.LG

AI总结 BiPrompt通过双重视觉语言模型双向提示优化,同时减轻视觉和文本中的非因果特征依赖,提升模型在分布偏移下的鲁棒性和因果推理能力。

Comments Accepted at the AAAI 2026 Workshop AIR-FM, Assessing and Improving Reliability of Foundation Models in the Real World

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19294 2025-10-01 cs.CV cs.AI cs.CL 82%

Object Detection with Multimodal Large Vision-Language Models: An In-depth Review

Ranjan Sapkota, Manoj Karkee

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments First Peer Reviewed Review Paper for Object Detection with Vision-Language Models (VLMs)

Journal ref Information Fusion, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.06241 2025-07-15 cs.LG cs.AI 82%

DiPT: Enhancing LLM reasoning through diversified perspective-taking

Hoang Anh Just, Mahavir Dabas, Lifu Huang, Ming Jin, Ruoxi Jia

机构 * Virginia Tech(弗吉尼亚理工大学) UC Davis(加州大学戴维斯分校)

专题命中 推理与问题求解 :LLM(title,comments);language model(abstract);分类 cs.AI、cs.LG

Comments LLM Reasoning with Perspectives, NAACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02351 2025-06-04 cs.CL cs.AI cs.CV 82%

DIAMOND: An LLM-Driven Agent for Context-Aware Baseball Highlight Summarization

Jeonghun Kang, Soonmok Kwon, Joonseok Lee, Byung-Hak Kim

机构 * Seoul National University(首尔国立大学) CJ Corporation(CJ公司)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI;language model(comments)

Comments To appear in the First REALM (Research on Agent Language Models) workshop at ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25487 2026-08-27 cs.CL cs.IR 新提交 81%

ReliableRAG: Combating Misinformation in Retrieval-Augmented Generation via Reliability-Guided Reasoning Chains

ReliableRAG:通过可靠性引导推理链对抗检索增强生成中的错误信息

Jinpu Jiang, Xuan Wu, Wenhao Song, Bo Yang, You Zhou, Hongwei Ge, Heow Pueh Lee, Yanchun Liang, Chunguo Wu

机构 * College of Software, Jilin University(吉林大学软件学院) College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院) Key Laboratory of Symbolic Computation and Knowledge Engineering of Ministry of Education, College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院 教育部符号计算与知识工程重点实验室) College of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) National University of Singapore(新加坡国立大学) School of Computer Science, Zhuhai College of Science and Technology(珠海科技学院计算机学院)

专题命中 推理与问题求解 :large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.CL

AI总结 ReliableRAG是首个通过细粒度评估三元组缓解多跳问答中欺骗性错误信息的可靠性驱动框架,可提升RAG系统的事实可靠性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.25276 2026-08-27 cs.CL 新提交 81%

Groundhog Bit-Flip Attack: Seeding Infinite Generation Loops in Mixture-of-Experts LLMs through Bit Flips

土拨比特翻转攻击:通过比特翻转在混合专家大语言模型中植入无限生成循环

Huakang Lin, Tiancheng Zheng, Mingxuan Sun, Tianhong Xu, Fan Zhang, Yunsi Fei, Ruyi Ding

机构 * Louisiana State University(路易斯安那州立大学) Northeastern University(东北大学) Zhejiang University(浙江大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校) Southeast University(东南大学)

专题命中 推理与问题求解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究提出首个针对混合专家大语言模型的土拨比特翻转攻击,通过翻转路由层相关比特,可使平均输出膨胀率达5912%,揭示了MoE架构的鲁棒性漏洞。

Comments 9 pages, 3 figures; Accepted at EMNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24221 2026-08-26 cs.SE cs.CL cs.PL 新提交 81%

DeepRepoQA: Code Repository Question Answering with Deep Agent Exploration

DeepRepoQA:基于深度智能体探索的代码仓库问答系统

Weihan Peng, Yuling Shi, Yingwei Ma, Longfei Yun, Beijun Shen, Xiaodong Gu

专题命中 推理与问题求解 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对现有代码仓库问答方法缺乏深度推理能力的问题,提出基于LLM智能体与蒙特卡洛树搜索的DeepRepoQA框架,在SWE-QA基准上实现了性能显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24024 2026-08-26 cs.AI 新提交 81%

Beyond Confidence: Test-Time Scaling for Multi-Turn Search Agents via Retrieval Grounding

超越置信度:基于检索 grounding 的多轮搜索智能体测试时缩放

Hyunho Kook, Junhyuk So, Tianyu Fu, Haizhong Zheng, Beidi Chen

机构 * University of Southern California(南加州大学) Pohang University of Science and Technology (POSTECH)(浦项科技大学) Tsinghua University(清华大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 推理与问题求解 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对多轮搜索智能体中基于置信度投票因复制膨胀失效的问题,提出检索接地投票(RGV)方法,在四个基准和五个 LLM 上性能优于基线,准确率最高提升 5.4%

Comments Accepted to EMNLP 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.24022 2026-08-26 cs.CR cs.AI 新提交 81%

What Guides the Agent? Adjudicating Unauthorized Behavior via Localizing Behavior-Guiding Instructions

智能体的决策依据是什么?通过定位行为引导指令来裁决未授权行为

Yichao Gao, Yumo Zhang, Yunhao Yao, Haohua Du, Puhan Luo, Ruiqi Li, Zhiqiang Wang

专题命中 推理与问题求解 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对LLM智能体易受动态注入攻击的问题,提出Attnlocate框架,通过目标检测定位行为引导指令以裁决未授权行为,在多场景下表现优异且可跨模型迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23858 2026-08-26 cs.CR cs.AI 新提交 81%

Beyond the Mandate: A Systematic Security Analysis of the Agent Payments Protocol (AP2)

超越授权:智能体支付协议(AP2)的系统性安全分析

Avital Aviv, Parth A. Gandh, Ron Bitton, Asaf Shabtai

专题命中 推理与问题求解 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文对谷歌AP2 v0.2开展系统性安全分析,识别出48种威胁及8种高风险威胁,构建测试平台与扫描器,发现授权签名无法保障智能体交易反映用户意图。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.23541 2026-08-25 cs.MA cs.AI 新提交 81%

The Interaction Tax: When Communication Erases Diversity in Multi-Agent Teams

交互税:当多智能体团队中的沟通消除多样性时

Summer Eunhyung Ann, Haokun Liu, Chenhao Tan

专题命中 推理与问题求解 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 该研究提出“交互税”概念,发现多智能体LLM的完整方案交互会消除多样性,独立提议生成可避免收敛崩溃,交互仅在共享恰当信息时才有益。

Comments 14 pages, 3 figures. Accepted at ICML 2026 (PMLR 306)

详情

展开后加载摘要…

URL PDF HTML 收藏