arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18857 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18857 篇

2508.20373 2026-02-18 cs.CL cs.AI cs.LG 86%

NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems

NPG-Muse: 通过NP难图问题扩展长链推理

Yuyao Wang, Bowen Liu, Jianheng Tang, Nuo Chen, Yuhan Li, Qifan Zhang, Chenyi Zi, Chen Zhang, Jia Li

机构 * HKUST (GZ)(香港科技大学(广州)) Createlink Technology(创联科技)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 NPG-Muse通过引入NP难图问题作为合成训练语料库,提升大规模语言模型的长链推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20194 2026-01-29 cs.HC 86%

An Autonomous Agent Framework for Feature-Label Extraction from Device Dialogues and Automatic Multi-Dimensional Device Hosting Planning Based on Large Language Models

基于大语言模型的自主代理框架:用于设备对话中特征-标签提取与自动多维设备托管规划

Huichao Men, Yizhen Hu, Yu Gao, Xiaofeng Mou, Yi Xu, Xinhua Xiao

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

AI总结 本文提出AirAgent框架,利用大语言模型实现家庭空气系统的自主管理,通过双层协作架构提升空气质量和用户体验。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04261 2026-01-14 cs.CY 86%

Small Models Achieve Large Language Model Performance: Evaluating Reasoning-Enabled AI for Secure Child Welfare Research

小型模型实现大型语言模型性能:评估具备推理能力的AI用于安全儿童福利研究

Zia Qi, Brian E. Perron, Bryan G. Victor, Dragan Stoll, Joseph P. Ryan

专题命中 推理与问题求解 :language model(title,abstract);large language model(title)

AI总结 本研究展示小型模型通过扩展推理能力在儿童福利研究中实现高准确性,优于大模型,节省资源并提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07299 2025-12-15 cs.CV 86%

VADER: Towards Causal Video Anomaly Understanding with Relation-Aware Large Language Models

VADER:基于关系感知大型语言模型的因果视频异常理解

Ying Cheng, Yu-Ho Lin, Min-Hung Chen, Fu-En Yang, Shang-Hong Lai

机构 * National Tsing Hua University(清华大学) NVIDIA

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

AI总结 VADER通过整合关系感知的大型语言模型与视频关键帧特征,提升视频异常的因果理解与解释能力。

Comments Accepted to WACV 2026. Project page available at: https://vader-vau.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14555 2025-12-09 cs.CV 86%

Descrip3D: Enhancing Large Language Model-based 3D Scene Understanding with Object-Level Text Descriptions

Descrip3D: 通过物体级文本描述增强基于大语言模型的3D场景理解

Jintang Xue, Ganning Zhao, Jie-En Yao, Hong-En Chen, Yue Hu, Meida Chen, Suya You, C. -C. Jay Kuo

机构 * University of Southern California(南加州大学) DEVCOM Army Research Laboratory(国防部陆军研究实验室)

专题命中 推理与问题求解 :language model(title,abstract);large language model(title)

AI总结 Descrip3D通过引入物体级文本描述,提升大语言模型在3D场景理解中的关系推理能力,有效增强复杂室内场景的语义理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16264 2025-12-03 cs.CL cs.AI cs.HC cs.LG 86%

ParlAI Vote: A Web Platform for Analyzing Gender and Political Bias in Large Language Models

ParlAI Vote:一个用于分析大型语言模型中性别和政治偏见的网络平台

Wenjie Lin, Hange Liu, Yingying Zhuang, Xutao Mao, Jingwei Shi, Xudong Han, Tianyu Shi, Jinrui Yang

机构 * Purdue University(普渡大学) Johns Hopkins University(约翰霍普金斯大学) Vanderbilt University(范德比大学) University of Toronto(多伦多大学) The University of Melbourne(墨尔本大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 ParlAI Vote是一个用于分析大型语言模型中性别和政治偏见的网络平台,通过可视化和交互功能揭示LLMs在政治分析中的系统性偏见。

Comments online demo: https://euro-parl-vote-demo.vercel.app/; Video: https://www.youtube.com/@Jinrui-sf2jg

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15573 2025-11-20 cs.CY 86%

Two-Faced Social Agents: Context Collapse in Role-Conditioned Large Language Models

Vikram K Suresh

专题命中 推理与问题求解 :large language model(title);language model(title);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22396 2025-10-28 cs.CR 86%

PortGPT: Towards Automated Backporting Using Large Language Models

Zhaoyang Li, Zheng Yu, Jingyi Song, Meng Xu, Yuxuan Luo, Dongliang Mu

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

Comments Accepted by IEEE S&P 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15034 2025-10-24 cs.LG cs.AI cs.CL 86%

RL Tango: Reinforcing Generator and Verifier Together for Language Reasoning

Kaiwen Zha, Zhengqi Gao, Maohao Shen, Zhang-Wei Hong, Duane S. Boning, Dina Katabi

机构 * MIT(麻省理工学院) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments NeurIPS 2025. The first two authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20709 2025-09-26 cs.RO 86%

Digital Twin-Guided Robot Path Planning: A Beta-Bernoulli Fusion with Large Language Model as a Sensor

Mani Amani, Reza Akhavian

机构 * Department of Civil, Construction, and Environmental Engineering, San Diego State University, San Diego, CA, United States(土木、建设与环境工程系,圣地亚哥州立大学,美国圣地亚哥,加利福尼亚州) Department of Electrical and Computer Engineering, University of California, San Diego, San Diego, CA, United States(电气与计算机工程系,加州大学圣地亚哥分校,美国圣地亚哥,加利福尼亚州)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02965 2025-09-23 cs.CL cs.AI cs.LG 86%

CoLa: Learning to Interactively Collaborate with Large Language Models

Abhishek Sharma, Dan Goldwasser

机构 * Department of Computer Science(计算机科学系) Purdue University(普渡大学)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03864 2025-08-08 cs.AI cs.CL cs.LG 86%

DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search

Murong Yue, Wenlin Yao, Haitao Mi, Dian Yu, Ziyu Yao, Dong Yu

机构 * George Mason University(乔治·马歇尔大学) Tencent AI Lab(腾讯AI实验室)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Accepted to ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04837 2025-06-06 cs.CV 86%

OpenMaskDINO3D : Reasoning 3D Segmentation via Large Language Model

Kunshen Zhang

机构 * Wuhan University(武汉大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

Comments Project Page: https://github.com/Zhangkuns/OpenMaskDINO3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.23487 2025-06-03 cs.AI cs.CL cs.LG 86%

Large Language and Reasoning Models are Shallow Disjunctive Reasoners

Irtaza Khalid, Amir Masoud Nourollah, Steven Schockaert

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments ACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15093 2025-04-22 cs.CL cs.AI cs.LG 86%

Rethinking the Potential of Multimodality in Collaborative Problem Solving Diagnosis with Large Language Models

K. Wong, B. Wu, S. Bulathwela, M. Cukurova

机构 * UCL Knowledge Lab, Institute of Education, University College London, UK(伦敦大学学院教育研究所知识实验室) AI Centre, Dept. of Computer Science, University College London, UK(伦敦大学学院人工智能中心)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for 26th International Conference on Artificial Intelligence in Education (AIED 2025), 22 - 26 July 2025, Palermo, Italy. 17 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04781 2025-04-08 cs.CV 86%

OCC-MLLM-CoT-Alpha: Towards Multi-stage Occlusion Recognition Based on Large Language Models via 3D-Aware Supervision and Chain-of-Thoughts Guidance

Chaoyi Wang, Baoqing Li, Xinhan Di

专题命中 推理与问题求解 :language model(title,abstract);large language model(title)

Comments This work has been accepted to the Multimodal Algorithmic Reasoning (MAR) Workshop at CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18371 2024-12-30 cs.SE 86%

Defining and Detecting the Defects of the Large Language Model-based Autonomous Agents

Kaiwen Ning, Jiachi Chen, Jingwen Zhang, Wei Li, Zexu Wang, Yuming Feng, Weizhe Zhang, Zibin Zheng

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14215 2024-11-22 cs.CL cs.AI cs.LG 86%

Evaluating the Robustness of Analogical Reasoning in Large Language Models

Martha Lewis, Melanie Mitchell

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

Comments 31 pages, 13 figures. arXiv admin note: text overlap with arXiv:2402.08955

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10740 2024-11-12 cs.CV 86%

FreeMotion: MoCap-Free Human Motion Synthesis with Multimodal Large Language Models

Zhikai Zhang, Yitang Li, Haofeng Huang, Mingxian Lin, Li Yi

专题命中 推理与问题求解 :large language model(title);language model(title);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08189 2024-10-11 cs.CV cs.RO 86%

SG-Nav: Online 3D Scene Graph Prompting for LLM-based Zero-shot Object Navigation

Hang Yin, Xiuwei Xu, Zhenyu Wu, Jie Zhou, Jiwen Lu

专题命中 推理与问题求解 :LLM(title,abstract);prompting(title)

Comments Accepted to NeurIPS 2024. Project page: https://bagh2178.github.io/SG-Nav/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09435 2024-09-17 cs.RO 86%

Behavior Tree Generation using Large Language Models for Sequential Manipulation Planning with Human Instructions and Feedback

Jicong Ao, Yansong Wu, Fan Wu, Sami Haddadin

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

Journal ref ICRA 2024 Workshop Exploring Role Allocation in Human-Robot Co-Manipulation

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19369 2024-06-10 cs.RO 86%

RAIL: Robot Affordance Imagination with Large Language Models

Ceng Zhang, Xin Meng, Dongchen Qi, Gregory S. Chirikjian

专题命中 推理与问题求解 :language model(title,abstract);large language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05568 2024-03-12 cs.HC 86%

Revolutionizing Mental Health Care through LangChain: A Journey with a Large Language Model

Aditi Singh, Abul Ehtesham, Saifuddin Mahmud, Jong-Hoon Kim

专题命中 推理与问题求解 :language model(title,abstract);large language model(title)

Comments 2024 IEEE 14th Annual Computing and Communication Workshop and Conference (CCWC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15657 2023-10-25 cs.SE 86%

Testing the Limits: Unusual Text Inputs Generation for Mobile App Crash Detection with Large Language Model

Zhe Liu, Chunyang Chen, Junjie Wang, Mengzhuo Chen, Boyu Wu, Xing Che, Dandan Wang, Qing Wang

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract)

Comments Accepted by IEEE/ACM International Conference on Software Engineering 2024 (ICSE 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03883 2026-06-03 cs.AI cs.LG 86%

Reasoning Structure of Large Language Models

大型语言模型的推理结构

Frédéric Berdoz, Luca A. Lanzendörfer, Fabian Farestam, Roger Wattenhofer

机构 * ETH Zurich, Switzerland(苏黎世联邦理工学院)

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.AI、cs.LG;LLM(comments)

AI总结 针对大型推理模型评估中隐藏不同推理结构的问题,提出基于逻辑谜题的基准测试和将非结构化轨迹转化为可验证推理图的方法,并定义推理效率指标,以量化分析推理拓扑结构。

Comments Accepted at ICML 2026 and presented at the ICLR 2026 workshop on LLM reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08989 2025-06-11 cs.LG cs.CL 86%

SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning

Xiao Liang, Zhong-Zhi Li, Yeyun Gong, Yang Wang, Hengyuan Zhang, Yelong Shen, Ying Nian Wu, Weizhu Chen

机构 * University of California Los Angeles(加州大学洛杉矶分校) School of Artificial Intelligence Chinese Academy of Sciences(中国科学院人工智能学院) Microsoft(微软) Tsinghua University(清华大学)

专题命中 推理与问题求解 :LLM(title,comments);large language model(abstract,comments);language model(abstract,comments);分类 cs.CL、cs.LG

Comments Reinforcement Learning; Large Language Models; LLM Reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11821 2024-11-01 cs.LG cs.CL cs.IR cs.SI 86%

Microstructures and Accuracy of Graph Recall by Large Language Models

Yanbang Wang, Hejie Cui, Jon Kleinberg

专题命中 推理与问题求解 :large language model(title);language model(title);分类 cs.CL、cs.LG;LLM(comments)

Comments Accepted at NeurIPS 2024; Code available at: https://github.com/Abel0828/llm-graph-recall

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14613 2026-08-18 cs.AI 新提交 85%

Do LLM Agents Negotiate Rationally? A Mechanism-Design Framework for Verifiable Multi-Agent Interaction over A2A/MCP

大语言模型智能体是否进行理性协商?面向A2A/MCP的可验证多智能体交互机制设计框架

Wael Albayaydh, Rui Zhao

专题命中 推理与问题求解 :LLM(title,summary_cn);分类 cs.AI

AI总结 本研究针对A2A/MCP协议提出可验证多智能体交互机制设计框架,实验发现机制激励兼容性无法自动迁移至大语言模型智能体行为,相关成果连接经典多智能体理论与现代LLM智能体基础设施。

Comments 20 pages , 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14610 2026-08-18 cs.AI 新提交 85%

When Do LLMs Apply the Wrong Law? Diagnosing LLM Failures in Temporal Legal Reasoning

大型语言模型何时适用错误法律?诊断大型语言模型在时间法律推理中的失败

Yiqian Huang, Shuyuan Zheng, Qianying Liu, Shaowen Peng, Yuntao Kong, Kotaro Funakoshi, Chuan Xiao, Manabu Okumura, Yang Cao

机构 * Institute of Science Tokyo(东京科学大学) Osaka University(大阪大学) NII LLMC(日本信息学研究所语言、语言学与媒体中心) Nara Institute of Science and Technology(奈良科学技术研究所) Center of Juris-Informatics, ROIS-DS(日本学术研究推进机构跨学科科学研究中心法学信息学中心)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文构建基准评估LLMs的时间适用法律判定能力,发现LLMs存在适用最新法律的偏差,该偏差源于强化学习塑造的显式推理导致推理路径多样性减少,通用推理能力更强的模型在时间法律推理中表现更差,为相关优化提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03093 2026-08-18 cs.CL cs.SD 85%

Revisiting Direct Speech-to-Text Translation with Speech LLMs: Better Scaling than CoT Prompting?

重新审视基于语音大语言模型的直接语音到文本翻译:比CoT提示更好的扩展性?

Oriol Pareras, Gerard I. Gállego, Federico Costa, Cristina España-Bonet, Javier Hernando

机构 * Barcelona Supercomputing Center, Spain(巴塞罗那超级计算中心,西班牙) Universitat Politècnica de Catalunya, Spain(加泰罗尼亚理工大学,西班牙) DFKI GmbH, Saarland Informatics Campus, Saarbrücken, Germany(德意志联邦计算机研究中心(DFKI) GmbH,萨尔布吕肯,德国)

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文比较了CoT和直接提示在增加S2TT数据量下的表现,发现直接提示在数据增加时表现更优,可能成为更大资源下的更有效方法。

Comments To appear in Proc. ICASSP 2026, May 04-08, 2026, Barcelona, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏