arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-03 至 2025-09-03 共收录 358 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 55 篇

2509.00570 2025-09-03 cs.RO 88%

ConceptBot: Enhancing Robot's Autonomy through Task Decomposition with Large Language Models and Knowledge Graph

Alessandro Leanza, Angelo Moroncelli, Giuseppe Vizzari, Francesco Braghin, Loris Roveda, Blerina Spahiu

机构 * Department of Innovative Technologies (DTI), Dalle Molle Institute for Artificial Intelligence (IDSIA), University of Applied Sciences(创新技术部门(DTI)、达摩迪人工智能研究所(IDSIA)、应用科学与艺术大学) Department of Mechanical Engineering, Politecnico di Milano(机械工程部门、米兰理工学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02297 2025-09-03 cs.AI 87%

Re-evaluating LLM-based Heuristic Search: A Case Study on the 3D Packing Problem

Guorui Quan, Mingfei Sun, Manuel López-Ibáñez

机构 * The University of Manchester(曼彻斯特大学) University of Manchester(曼彻斯特大学) Department of Computer Science(计算机科学系) Alliance Manchester Business School(曼彻斯特商业联盟学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02534 2025-09-03 cs.CL cs.LG 86%

Jointly Reinforcing Diversity and Quality in Language Model Generations

Tianjian Li, Yiming Zhang, Ping Yu, Swarnadeep Saha, Daniel Khashabi, Jason Weston, Jack Lanchantin, Tianlu Wang

机构 * Meta FAIR Carnegie Mellon University(卡内基梅隆大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);post-training(abstract);分类 cs.CL、cs.LG

Comments 29 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15567 2025-09-03 cs.AI cs.LG 86%

Intelligent Assistants for the Semiconductor Failure Analysis with LLM-Based Planning Agents

Aline Dobrovsky, Konstantin Schekotihin, Christian Burmer

机构 * University of the Bundeswehr Munich(联邦国防军大学慕尼黑) University Klagenfurt(克雷格弗尔特大学) Infineon Technologies AG(英飞凌科技)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments This technical report provides evaluation details of the experiments presented in the paper accepted to ISTFA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01716 2025-09-03 cs.AI cs.CL 86%

An LLM-enabled semantic-centric framework to consume privacy policies

Rui Zhao, Vladyslav Melnychuk, Jun Zhao, Jesse Wright, Nigel Shadbolt

机构 * University of Oxford(牛津大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01337 2025-09-03 cs.MM cs.AI cs.CL 86%

LLM-Guided Semantic Relational Reasoning for Multimodal Intent Recognition

Qianrui Zhou, Hua Xu, Yifan Wang, Xinzhi Dong, Hanlei Zhang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Information Science and Engineering, Hebei University of Science and Technology(河北科技大学信息科学与工程学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025 (Main Track, Long Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01378 2025-09-03 cs.MA cs.AI cs.RO 85%

RALLY: Role-Adaptive LLM-Driven Yoked Navigation for Agentic UAV Swarms

Ziyao Wang, Rongpeng Li, Sizhao Li, Yuming Xiang, Haiping Wang, Zhifeng Zhao, Honggang Zhang

机构 * Hangzhou Institute for Advanced Study, UCAS(杭州高等研究机构,中国科学院大学) Zhejiang University(浙江大学) Zhejiang Lab(浙江实验室) Macau University of Science and Technology(澳门科学理工学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03671 2025-09-03 cs.AI 85%

TRACE-CS: A Hybrid Logic-LLM System for Explainable Course Scheduling

Stylianos Loukas Vasileiou, William Yeoh

机构 * New Mexico State University(新墨西哥州立大学) Washington University in St. Louis(圣路易斯华盛顿大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21471 2025-09-03 cs.AI 85%

LUMIR: an LLM-Driven Unified Agent Framework for Multi-task Infrared Spectroscopy Reasoning

Zujie Xie, Zixuan Chen, Jiheng Liang, Xiangyang Yu, Ziru Yu

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02324 2025-09-03 cs.RO 85%

Language-Guided Long Horizon Manipulation with LLM-based Planning and Visual Perception

Changshi Zhou, Haichuan Xu, Ningquan Gu, Zhipeng Wang, Bin Cheng, Pengpeng Zhang, Yanchao Dong, Mitsuhiro Hayashibe, Yanmin Zhou, Bin He

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03275 2025-09-03 cs.CL cs.AI cs.LG cs.LO 85%

Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning

DiJia Su, Hanlin Zhu, Yingchen Xu, Jiantao Jiao, Yuandong Tian, Qinqing Zheng

机构 * Meta AI

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01822 2025-09-03 cs.LG cs.AI 84%

When LLM Meets Time Series: Can LLMs Perform Multi-Step Time Series Reasoning and Inference

Wen Ye, Jinbo Liu, Defu Cao, Wei Yang, Yan Liu

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00664 2025-09-03 cs.CV cs.AI 83%

Fusion to Enhance: Fusion Visual Encoder to Enhance Multimodal Language Model

Yifei She, Huangxuan Wu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00125 2025-09-03 cs.AI 83%

Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning

Ang Li, Zhihang Yuan, Yang Zhang, Shouda Liu, Yisen Wang

机构 * PKU(北京大学) ByteDance Seed(字节跳动种子)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01016 2025-09-03 cs.AI cs.CL cs.LG cs.NE 82%

Analysis of Error Sources in LLM-based Hypothesis Search for Few-Shot Rule Induction

Aishni Parab, Hongjing Lu, Ying Nian Wu, Sumit Gulwani

机构 * Department of Statistics, University of California, Los Angeles(统计学系,加州大学洛杉矶分校) Microsoft, Redmond, WA(微软公司,西雅图,华盛顿州) Department of Psychology, University of California, Los Angeles(心理学系,加州大学洛杉矶分校)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments This is the preprint version corresponding to our NeurIPS 2025 Workshop on Multimodal Algorithmic Reasoning submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.14446 2025-09-03 cs.CV cs.LG 79%

VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision

Yi Xu, Yuxin Hu, Zaiwei Zhang, Gregory P. Meyer, Siva Karthik Mustikovela, Siddhartha Srinivasa, Eric M. Wolff, Xin Huang

机构 * Cruise LLC (GM)(Cruise LLC(GM)) Northeastern University(东北大学) OpenAI(开放人工智能研究所) Meta University of Washington(华盛顿大学) Waymo LLC

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.LG

Comments Accepted by CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02208 2025-09-03 cs.LG cs.AI 79%

Baichuan-M2: Scaling Medical Capability with Large Verifier System

M2 Team, Chengfeng Dou, Chong Liu, Fan Yang, Fei Li, Jiyuan Jia, Mingyang Chen, Qiang Ju, Shuai Wang, Shunya Dang, Tianpeng Li, Xiangrong Zeng, Yijie Zhou, Chenzheng Zhu, Da Pan, Fei Deng, Guangwei Ai, Guosheng Dong, Hongda Zhang, Jinyang Tai, Jixiang Hong, Kai Lu, Linzhuang Sun, Peidong Guo, Qian Ma, Rihui Xin, Shihui Yang, Shusen Zhang, Yichuan Mo, Zheng Liang, Zhishou Zhang, Hengfu Cui, Zuyi Zhu, Xiaochuan Wang

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Baichuan-M2 Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01236 2025-09-03 cs.CL cs.AI 79%

Rethinking the Chain-of-Thought: The Roles of In-Context Learning and Pre-trained Priors

Hao Yang, Zhiyu Yang, Yunjie Zhang, Shanyi Zhu, Lin Yang

机构 * School of Intelligence Science and Technology, National Key Laboratory for Novel Software Technology, Nanjing University(智能科学与技术学院,新型软件技术国家重点实验室,南京大学) School of Computing and Information Systems, Singapore Management University(计算与信息系统学院,新加坡管理大学) Central South University(中南大学) School of Global Education and Development, International Chinese Language Education, University of Chinese Academy of Social Sciences(全球教育与发展学院,国际中文教育,中国社会科学院)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12345 2025-09-03 cs.CL cs.AI 79%

General Table Question Answering via Answer-Formula Joint Generation

Zhongyuan Wang, Richong Zhang, Zhijie Nie, Hangyu Mao

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00600 2025-09-03 cs.DB cs.AI cs.CL 79%

Semantic Integrity Constraints: Declarative Guardrails for AI-Augmented Data Processing Systems

Alexander W. Lee, Justin Chan, Michael Fu, Nicolas Kim, Akshay Mehta, Deepti Raghavan, Ugur Cetintemel

机构 * Brown University(布朗大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref PVLDB, 18(11): 4073 - 4080, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16534 2025-09-03 cs.CL cs.AI cs.CY 79%

Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs

Jonathan Rystrøm, Hannah Rose Kirk, Scott Hale

机构 * Oxford Internet Institute(牛津互联网研究所) University of Oxford(牛津大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at OMMM@RANLP2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00483 2025-09-03 cs.CV 78%

Exploring Decision-Making Capabilities of LLM Agents: An Experimental Study on Jump-Jump Game

Juwu Li

机构 * Jiangxi Teachers College(江西教师学院)

专题命中 推理与问题求解 :LLM(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.02401 2025-09-03 cs.AI 77%

Towards Agents That Know When They Don't Know: Uncertainty as a Control Signal for Structured Reasoning

Josefa Lia Stoisser, Marc Boubnovski Martell, Lawrence Phillips, Gianluca Mazzoni, Lea Mørch Harder, Philip Torr, Jesper Ferkinghoff-Borg, Kaspar Martens, Julien Fauqueur

机构 * Novo Nordisk(诺和制药) University of Oxford(牛津大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01468 2025-09-03 cs.CL 77%

Robust Knowledge Editing via Explicit Reasoning Chains for Distractor-Resilient Multi-Hop QA

Yuchen Wu, Liang Ding, Li Shen, Dacheng Tao

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Sydney(悉尼大学) Shenzhen Campus of Sun Yat-sen University(中山大学深圳校区) Nanyang Technological University(南洋理工大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01363 2025-09-03 cs.CL 77%

Reasoning Vectors: Transferring Chain-of-Thought Capabilities via Task Arithmetic

Mohammad Zbeeb, Hasan Abed Al Kader Hammoud, Bernard Ghanem

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11423 2025-09-03 cs.CL 77%

When Thinking Fails: The Pitfalls of Reasoning for Instruction-Following in LLMs

Xiaomin Li, Zhou Yu, Zhiwei Zhang, Xupeng Chen, Ziji Zhang, Yingying Zhuang, Narayanan Sadagopan, Anurag Beniwal

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07557 2025-09-03 cs.LG 77%

Using LLMs for Analyzing AIS Data

Gaspard Merten, Gilles Dejaegere, Mahmoud Sakr

机构 * Data Science and Engineering Lab(数据科学与工程实验室) Université libre de Bruxelles(布鲁塞尔自由大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Journal ref 2025 Symposium on Maritime Informatics and Robotics (MARIS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00134 2025-09-03 cs.CL 77%

Personalized Causal Graph Reasoning for LLMs: An Implementation for Dietary Recommendations

Zhongqi Yang, Amir Rahmani

机构 * Department of Computer Science, University of California, Irvine(加州大学尔湾分校计算机科学系) School of Nursing, University of California, Irvine(加州大学尔湾分校护理学院)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00711 2025-09-03 cs.CV cs.AI 77%

VIKSER: Visual Knowledge-Driven Self-Reinforcing Reasoning Framework

Chao Wang, Chunbai Zhang, Yongxiao Tian, Yang Zhou, Yan Peng

机构 * School of Future Technology, Shanghai University(未来技术学院,上海大学) School of Mechatronic Engineering and Automation, Shanghai University(机械电子工程与自动化学院,上海大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

Comments 14 pages,17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17761 2025-09-03 cs.LG 77%

Towards a Unified Textual Graph Framework for Spectral Reasoning via Physical and Chemical Information Fusion

Jiheng Liang, Ziru Yu, Zujie Xie, Yuchen Guo, Yulan Guo, Xiangyang Yu

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments We need to further modify and supplement the experiment

详情

展开后加载摘要…

URL PDF HTML 收藏