arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18875 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18875 篇

2602.13574 2026-02-17 cs.SE cs.CR 85%

Execution-State-Aware LLM Reasoning for Automated Proof-of-Vulnerability Generation

面向执行状态的LLM推理用于自动化漏洞证明生成

Haoyu Li, Xijia Che, Yanhao Wang, Xiaojing Liao, Luyi Xing

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 DrillAgent通过结合LLM语义推理与执行状态反馈,实现自动化漏洞证明生成,显著提升漏洞检测效率。

Comments Version 1.0 (13 pages, 7 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04419 2026-02-17 cs.RO 85%

Integrated Exploration and Sequential Manipulation on Scene Graph with LLM-based Situated Replanning

基于场景图的LLM定位再规划集成探索与顺序操作

Heqing Yang, Ziyuan Jiao, Shu Wang, Yida Niu, Si Liu, Hangxin Liu

机构 * Beihang University(北航大学) State Key Laboratory of General Artificial Intelligence(一般人工智能国家重点实验室) University of California, Los Angeles(加州大学洛杉矶分校) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 EPoG通过结合基于图的全局规划器与LLM的定位局部规划器,实现探索与顺序操作规划的无缝结合,有效提升机器人在部分已知环境中的任务执行效率。

Comments 8 pages, 7 figures; accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20577 2026-02-16 cs.RO 85%

MeCo: Enhancing LLM-Empowered Multi-Robot Collaboration via Similar Task Memoization

MeCo:通过相似任务记忆增强基于大语言模型的多机器人协作

Baiqing Wang, Helei Cui, Bo Zhang, Xiaolong Zheng, Bin Guo, Zhiwen Yu

机构 * Northwestern Polytechnical University(西北工业大学) Beijing University of Posts and Telecommunications(北京邮电大学) Harbin Engineering University(哈尔滨工程大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 MeCo通过引入相似任务记忆化机制,有效提升多机器人协作的效率和成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02995 2026-02-16 cs.SD 85%

AudioToolAgent: An Agentic Framework for Audio-Language Models

AudioToolAgent: 一种用于音频-语言模型的代理框架

Gijs Wijngaard, Elia Formisano, Michel Dumontier, Jenia Jitsev

机构 * Maastricht University(马斯特里赫特大学) LAION Juelich Supercomputing Center (JSC), Research Center Juelich (FZJ)(尤利希超级计算中心(JSC),尤利希研究中心(FZJ))

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 AudioToolAgent通过中央LLM代理协调音频-语言模型作为工具,提升音频理解任务的多步骤推理和工具调用能力,实验结果显示在多个基准测试中达到最先进的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04683 2026-02-12 cs.SD 85%

UniAudio 2.0: A Unified Audio Language Model with Text-Aligned Factorized Audio Tokenization

UniAudio 2.0:一种具有文本对齐因子化音频标记化的统一音频语言模型

Dongchao Yang, Yuanyuan Wang, Dading Chong, Songxiang Liu, Xixin Wu, Helen Meng

机构 * The Chinese University of Hong Kong, China(香港中文大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);foundation model(abstract)

AI总结 UniAudio 2.0通过引入ReasoningCodec和统一自回归架构,实现了文本对齐的因子化音频标记化,提升了音频理解和生成性能,并在多种任务中展现了强大的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10684 2026-02-12 cs.HC 85%

Privacy Control in Conversational LLM Platforms: A Walkthrough Study

对话式大语言模型平台中的隐私控制:一项 walkthrough 研究

Zhuoyang Li, Yanlai Wu, Yao Li, Xinning Gui, Yuhan Luo

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究对话式大语言模型平台的数据控制机制,揭示用户数据生成与共享的复杂性,并为开发者和政策制定者提供隐私控制优化的实用建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08421 2026-02-10 cs.RO 85%

Decentralized Intent-Based Multi-Robot Task Planner with LLM Oracles on Hyperledger Fabric

基于Hyperledger Fabric的去中心化意图多机器人任务规划器与LLM预言机

Farhad Keramat, Salma Salimi, Tomi Westerlund

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于Hyperledger Fabric的去中心化多机器人任务规划器,结合LLM预言机与新聚合方法,实现意图分解与多机器人协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08384 2026-02-10 cs.CR 85%

Towards Real-World Industrial-Scale Verification: LLM-Driven Theorem Proving on seL4

迈向现实工业级验证:基于LLM的定理证明在seL4上的应用

Jianyu Zhang, Fuyuan Zhang, Jiayi Lu, Jilin Hu, Xiaoyi Yin, Long Zhang, Feng Yang, Yongwang Zhao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出AutoReal,一种基于LLM的工业级定理证明方法,通过轻量级本地部署和改进的证明训练,实现了在seL4验证项目中51.67%的证明成功率,并在其他安全项目中达到53.88%的证明成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21880 2026-02-10 cs.CL cs.AI cs.LG 85%

No Prompt Left Behind: Exploiting Zero-Variance Prompts in LLM Reinforcement Learning via Entropy-Guided Advantage Shaping

无提示被忽视:通过熵引导的优势塑造利用零方差提示进行LLM强化学习

Thanh-Long V. Le, Myeongho Jeon, Kim Vu, Viet Lai, Eunho Yang

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过熵引导的优势塑造,RL-ZVP利用零方差提示提升LLM推理能力,显著优于GRPO及其他基线方法。

Comments ICLR 2026 camera-ready version

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07371 2026-02-10 cs.DB 85%

DeepPrep: An LLM-Powered Agentic System for Autonomous Data Preparation

DeepPrep: 一种基于大语言模型的自主数据准备代理系统

Meihao Fan, Ju Fan, Yuxin Zhang, Shaolei Zhang, Xiaoyong Du, Jie Song, Peng Li, Fuxin Jiang, Tieying Zhang, Jianjun Chen

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 DeepPrep通过基于树状代理推理和渐进式训练框架,实现高效且准确的数据准备,相比闭源模型具有更低的成本和更广的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06325 2026-02-09 cs.CR cs.SE 85%

Identifying Adversary Tactics and Techniques in Malware Binaries with an LLM Agent

利用LLM代理识别恶意软件二进制中的攻击战术与技术

Zhou Xuan, Xiangzhe Xu, Mingwei Zheng, Louis Zheng-Hua Tan, Jinyao Guo, Tiantai Zhang, Le Yu, Chengpeng Wang, Xiangyu Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 TTPDetect通过结合密集检索与LLM神经检索,利用LLM代理识别恶意软件二进制中的TTPs,实现高精度和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05446 2026-02-06 cs.HC 85%

DiLLS: Interactive Diagnosis of LLM-based Multi-agent Systems via Layered Summary of Agent Behaviors

通过代理行为分层总结实现基于大语言模型的多代理系统交互诊断:DiLLS

Rui Sheng, Yukun Yang, Chuhan Shi, Yanna Lin, Zixin Chen, Huamin Qu, Furui Cheng

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 DiLLS通过多层行为总结,帮助开发者更高效地诊断和理解基于LLM的多代理系统故障。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04972 2026-02-06 cs.CY 85%

Learning Context Matters: Measuring and Diagnosing Personalization Gaps in LLM-Based Instructional Design

学习上下文很重要:在基于LLM的教学设计中测量和诊断个性化差距

Johaun Hatchett, Debshila Basu Mallick, Brittany C. Bradford, Richard G. Baraniuk

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种框架,用于测量和诊断学习上下文对基于LLM教学系统的影响,发现提供学习上下文能改善LLM的教学策略,但尚未实现可靠的个性化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04225 2026-02-05 cs.IR 85%

Following the TRAIL: Predicting and Explaining Tomorrow's Hits with a Fine-Tuned LLM

跟随TRAIL:利用微调LLM预测和解释明天的爆款

Yinan Zhang, Zhixi Chen, Jiazheng Jing, Zhiqi Shen

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 TRAIL通过微调LLM联合预测短期物品流行度并生成自然语言解释,提升推荐系统的准确性与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04224 2026-02-05 cs.LG cs.AI cs.CL cs.CR math.OC 85%

RAPO: Risk-Aware Preference Optimization for Generalizable Safe Reasoning

RAPO:面向通用安全推理的风险感知优化

Zeming Wei, Qiaosheng Zhang, Xia Hu, Xingcheng Xu

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 推理与问题求解 :preference optimization(title,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 RAPO 提出了一种风险感知优化框架,通过提升安全推理的泛化能力,增强大型推理模型在复杂攻击下的安全性与实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02313 2026-02-04 cs.AI cs.CL cs.LG 85%

Interpreting and Controlling LLM Reasoning through Integrated Policy Gradient

通过集成策略梯度解释和控制大语言模型的推理

Changming Li, Kaixing Zhang, Haoyun Xu, Yingdong Shi, Zheng Zhang, Kaitao Song, Kan Ren

机构 * Independent Researcher(独立研究者) ShanghaiTech University(上海科技大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出集成策略梯度框架,通过反向传播复合结果信号,实现对大语言模型推理行为的精确解释与控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09917 2026-02-03 cs.SE 85%

Enhancing LLM-based Specification Generation via Program Slicing and Logical Deletion

通过程序切片和逻辑删除增强基于LLM的规范生成

Zehan Chen, Long Zhang, Zhiwei Zhang, JingJing Zhang, Ruoyu Zhou, Yulong Shen, JianFeng Ma, Lin Yang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 SLD-Spec通过程序切片和逻辑删除提升LLM生成规范的准确性和完整性

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21876 2026-01-30 cs.RO 85%

LLM-Driven Scenario-Aware Planning for Autonomous Driving

基于大语言模型的场景感知规划用于自动驾驶

He Li, Zhaowei Chen, Rui Gao, Guoliang Li, Qi Hao, Shuai Wang, Chengzhong Xu

机构 * University of Macau(澳门大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Southern University of Science and Technology(南方科技大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出LAP,一种基于大语言模型的自适应规划方法,通过场景理解与联合优化实现自动驾驶中的高速与精确驾驶平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09101 2026-01-30 cs.HC 85%

A Survey of LLM Alignment: Instruction Understanding, Intention Reasoning, and Reliable Generation

大型语言模型对齐综述:指令理解、意图推理和可靠生成

Zongyu Chang, Feihong Lu, Ziqin Zhu, Qian Li, Cheng Ji, Tao Yang, Zhuo Chen, Hao Peng, Yang Liu, Ruifeng Xu, Yangqiu Song, Jianxin Li, Shangguang Wang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文综述了大型语言模型在指令理解、意图推理和可靠生成方面的挑战与解决方案,旨在提升模型在现实应用中的可靠性与适应性。

Comments 37 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01203 2026-01-30 cs.SI 85%

HetGCoT: Heterogeneous Graph-Enhanced Chain-of-Thought LLM Reasoning for Academic Question Answering

HetGCoT:异构图增强的链式思考LLM推理用于学术问答

Runsong Jia, Mengjia Wu, Ying Ding, Jie Lu, Yi Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 HetGCoT通过异构图增强链式思考LLM推理,提升学术问答的可解释性和准确性。

Comments Findings of the Association for Computational Linguistics: EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19540 2026-01-28 cs.HC 85%

"Do I Trust the AI?" Towards Trustworthy AI-Assisted Diagnosis: Understanding User Perception in LLM-Supported Reasoning

我是否信任AI?:迈向可信的AI辅助诊断:理解用户在LLM支持推理中的感知

Yuansong Xu, Yichao Zhu, Haokai Wang, Yuchen Wu, Yang Ouyang, Hanlu Li, Wenzhe Zhou, Xinyu Liu, Chang Jiang, Quan Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文研究医生对LLM临床推理能力的感知,通过实验揭示医生对LLM诊断能力的评估,并探讨提升医生与LLM协作可信度的方法。

Comments Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems (CHI'26), April 13--17, 2026, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18492 2026-01-27 cs.RO 85%

DV-VLN: Dual Verification for Reliable LLM-Based Vision-and-Language Navigation

DV-VLN:基于可靠大语言模型的视觉-语言导航的双重验证

Zijun Li, Shijie Li, Zhenxi Zhang, Bin Li, Shoujun Zhou

机构 * Robotics Engineering Program, College of Engineering, Zhejiang Normal University(浙江师范大学工程学院机器人工程专业) Shenzhen Institutes of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Department of Health Technology and Informatics, The Hong Kong Polytechnic University(香港理工大学健康科技与信息技术系)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 DV-VLN通过生成-验证范式提升大语言模型在视觉-语言导航中的可靠性,通过双重验证机制提高导航决策的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22922 2026-01-27 cs.HC 85%

Improving Human Verification of LLM Reasoning through Interactive Explanation Interfaces

通过交互式解释界面提高LLM推理的人类验证

Runtao Zhou, Giang Nguyen, Nikita Kharya, Anh Totti Nguyen, Chirag Agarwal

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出三种交互式推理界面,通过增强用户对LLM推理过程的理解,提高人类验证效率和准确性。

Comments 19 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17418 2026-01-27 cs.HC 85%

GraphPilot: GUI Task Automation with One-Step LLM Reasoning Powered by Knowledge Graph

GraphPilot: 基于知识图谱的GUI任务自动化:由LLM推理一步完成

Mingxian Yu, Siqi Luo, Xu Chen

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 GraphPilot通过基于知识图谱的LLM推理一步完成GUI任务自动化,显著提升任务完成率并降低延迟。

Comments This paper is accepted by the Journal of Intelligent Computing and Networking (JICN) for publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12148 2026-01-27 cs.SE 85%

Many Hands Make Light Work: An LLM-based Multi-Agent System for Detecting Malicious PyPI Packages

众手成炬:基于LLM的多智能体系统用于检测恶意PyPI包

Muhammad Umar Zeshan, Motunrayo Ibiyo, Claudio Di Sipio, Phuong T. Nguyen, Davide Di Ruscio

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出LAMPS,一种基于LLM的多智能体系统,通过协作检测恶意PyPI包,实现高准确率和显著的性能提升。

Comments The paper has been peer-reviewed and accepted for publication to the Journal of Systems and Software (https://www.sciencedirect.com/journal/journal-of-systems-and-software)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15331 2026-01-27 cs.HC 85%

DesignerlyLoop: Forming Design Intent through Curated Reasoning for Human-LLM Alignment

DesignerlyLoop: 通过精选推理形成设计意图以实现人-大语言模型对齐

Anqi Wang, Zhengyi Li, Xin Tong, Pan Hui

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 DesignerlyLoop通过精选推理提升人-大语言模型在设计任务中的对齐,改进设计质量和创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15047 2026-01-22 cs.MA cs.GT 85%

Game-Theoretic Lens on LLM-based Multi-Agent Systems

基于博弈论的基于大语言模型的多智能体系统视角

Jianing Hao, Han Ding, Yuanjian Xu, Tianze Sun, Ran Chen, Wanbo Zhang, Guang Zhang, Siguang Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过博弈论视角,系统综述了基于大语言模型的多智能体系统,构建了理解、比较和指导未来研究的框架。

Comments 9 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14343 2026-01-22 cs.CR cs.SY eess.SY 85%

Rethinking On-Device LLM Reasoning: Why Analogical Mapping Outperforms Abstract Thinking for IoT DDoS Detection

重新思考设备端LLM推理:为什么类比映射优于抽象思维用于IoT DDoS检测

William Pan, Guiran Liu, Binrong Zhu, Qun Wang, Yingzhou Lu, Beiyu Lin, Rose Qingyang Hu

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出一种结合Co_T和RAG的物联网边缘DDoS检测框架,通过示例驱动推理提升小型ODLLMs在资源受限下的检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13096 2026-01-21 cs.RO cs.CV 85%

LLM-VLM Fusion Framework for Autonomous Maritime Port Inspection using a Heterogeneous UAV-USV System

基于异构无人机-水下机器人系统的LLM-VLM融合框架用于自主港口检测

Muhayy Ud Din, Waseem Akram, Ahsan B. Bakht, Irfan Hussain

机构 * Khalifa University Center for Autonomous Robotic Systems (KUCARS)(卡利法大学自主机器人系统中心(KUCARS)) Khalifa University(卡利法大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于LLM和VLM的融合框架,利用异构无人机-水下机器人系统实现自主港口检测,通过符号规划与语义检测提升检测效率和安全性。

Comments submitted in AEJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10332 2026-01-16 cs.CV 85%

Think-Then-Generate: Reasoning-Aware Text-to-Image Diffusion with LLM Encoders

思考-然后-生成:基于LLM编码器的推理感知文本到图像扩散模型

Siqi Kou, Jiachun Jin, Zetong Zhou, Ye Ma, Yugang Wang, Quan Chen, Peng Jiang, Xiao Yang, Jun Zhu, Kai Yu, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Kuaishou Technology(快手科技) Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出基于LLM编码器的推理感知文本到图像扩散模型,通过推理重写提示提升生成质量,达到接近GPT-4的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏