arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-01 至 2025-10-01 共收录 58 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 58 篇

2509.25604 2025-10-01 cs.CL cs.LG 91%

RFG: Test-Time Scaling for Diffusion Large Language Model Reasoning with Reward-Free Guidance

Tianlang Chen, Minkai Xu, Jure Leskovec, Stefano Ermon

机构 * Stanford University(斯坦福大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);SFT(abstract)

Comments 27 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01413 2025-10-01 cs.CV cs.AI cs.CL cs.LG 90%

Incentivizing Reasoning for Advanced Instruction-Following of Large Language Models

Yulei Qin, Gang Li, Zongyi Li, Zihan Xu, Yuchen Shi, Zhekai Lin, Xiao Cui, Ke Li, Xing Sun

机构 * Youtu-Agent Team(YouTu-Agent团队)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to NeurIPS 2025; 15 pages of main body, 5 tables, 5 figures, 42 pages of appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25194 2025-10-01 cs.SE physics.comp-ph 90%

Automated Code Development for PDE Solvers Using Large Language Models

Haoyang Wu, Xinxin Zhang, Lailai Zhu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25529 2025-10-01 cs.CY cs.LG 89%

Personalized Auto-Grading and Feedback System for Constructive Geometry Tasks Using Large Language Models on an Online Math Platform

Yong Oh Lee, Byeonghun Bang, Joohyun Lee, Sejun Oh

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12838 2025-10-01 cs.RO cs.AI cs.MA 89%

Multi-Robot Task Planning for Multi-Object Retrieval Tasks with Distributed On-Site Knowledge via Large Language Models

Kento Murata, Shoichi Hasegawa, Tomochika Ishikawa, Yoshinobu Hagiwara, Akira Taniguchi, Lotfi El Hafi, Tadahiro Taniguchi

机构 * Graduate School of Information Science and Engineering(信息科学与工程研究生学校) Ritsumeikan University(立命馆大学) College of Information Science and Engineering(信息科学与工程学院) Faculty of Science and Engineering(科学与工程学部) Soka University(早稻田大学) Research Organization of Science and Technology(科学与技术研究机构) Graduate School of Informatics(信息学研究生学校) Kyoto University(京都大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

Comments Submitted to AROB-ISBC 2026 (Journal Track option)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23459 2025-10-01 cs.CR cs.CL 89%

MaskSQL: Safeguarding Privacy for LLM-Based Text-to-SQL via Abstraction

Sepideh Abedini, Shubhankar Mohapatra, D. B. Emerson, Masoumeh Shafieinejad, Jesse C. Cresswell, Xi He

机构 * University of Waterloo(多伦多大学) Vector Institute(向量研究所) Layer 6 AI

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments Accepted to the 3rd Workshop on Regulatable ML at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26345 2025-10-01 cs.AI 88%

SafeBehavior: Simulating Human-Like Multistage Reasoning to Mitigate Jailbreak Attacks in Large Language Models

Qinjian Zhao, Jiaqi Wang, Zhiqiang Gao, Zhihao Dou, Belal Abuhaija, Kaizhu Huang

机构 * Wenzhou-Kean University(温州市凯恩大学) University of Bremen(不莱梅大学) Case Western Reserve University(凯斯西储大学) Duke Kunshan University(杜克昆山大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 27 pages, 5 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26140 2025-10-01 cs.SD cs.AI 88%

OWL: Geometry-Aware Spatial Reasoning for Audio Large Language Models

Subrata Biswas, Mohammad Nur Hossain Khan, Bashima Islam

机构 * Department of Electrical & Computer Engineering(电气与计算机工程系) Worcester Polytechnic Institute(沃斯特理工大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15734 2025-10-01 cs.CL cs.AI cs.LG 87%

DEBATE, TRAIN, EVOLVE: Self Evolution of Language Model Reasoning

Gaurav Srivastava, Zhenyu Bi, Meng Lu, Xuan Wang

机构 * Department of Computer Science, Virginia Tech, USA(弗吉尼亚理工大学计算机科学系)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25885 2025-10-01 cs.AI 85%

SafeMind: Benchmarking and Mitigating Safety Risks in Embodied LLM Agents

Ruolin Chen, Yinqian Sun, Jihang Wang, Mingyang Lv, Qian Zhang, Yi Zeng

机构 * Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences(脑启发认知AI实验室,自动化研究所,中国科学院) Beijing Key Laboratory of Safe AI and Superalignment(北京安全AI与超对齐关键实验室) Beijing Institute of AI Safety and Governance(北京AI安全与治理研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Long-term AI(长期AI)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01245 2025-10-01 cs.AI cs.MA cs.OS 85%

Towards Agentic OS: An LLM Agent Framework for Linux Schedulers

Yusheng Zheng, Yanpeng Hu, Wei Zhang, Andi Quinn

机构 * UC Santa Cruz, CA, USA(加州大学圣克ruz分校) University of Connecticut(康涅狄格大学) ShanghaiTech University(上海科技大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref MLforSystem 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15849 2025-10-01 cs.CL cs.AI cs.LG 85%

The Impact of Language Mixing on Bilingual LLM Reasoning

Yihao Li, Jiayi Xin, Miranda Muqing Miao, Qi Long, Lyle Ungar

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11812 2025-10-01 cs.AI cs.CL cs.LG 83%

On the Performance of LLMs for Real Estate Appraisal

Margot Geerts, Manon Reusens, Bart Baesens, Seppe vanden Broucke, Jochen De Weerdt

机构 * LIRIS, KU Leuven, Leuven, Belgium(LIRIS,KU莱顿,比利时) Department of Business Informatics and Operations Management, Ghent University, Ghent, Belgium(商业信息学与运营管理系,根特大学,比利时) Department of Decision Analytics and Risk, University of Southampton, Southampton, UK(决策分析与风险系,南安普顿大学,英国)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at ECML-PKDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06266 2025-10-01 cs.CV 82%

Spatial Reasoning with Vision-Language Models in Ego-Centric Multi-View Scenes

Mohsen Gholami, Ahmad Rezaei, Zhou Weimin, Sitong Mao, Shunbo Zhou, Yong Zhang, Mohammad Akbari

机构 * Huawei Technologies Canada(华为技术加拿大分公司) Huawei Cloud Project Page Code Ego3D-Bench(华为云项目页面代码Ego3D-Bench)

专题命中 推理与问题求解 :language model(title,abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19294 2025-10-01 cs.CV cs.AI cs.CL 82%

Object Detection with Multimodal Large Vision-Language Models: An In-depth Review

Ranjan Sapkota, Manoj Karkee

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.CL、cs.AI

Comments First Peer Reviewed Review Paper for Object Detection with Vision-Language Models (VLMs)

Journal ref Information Fusion, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23285 2025-10-01 cs.AI 81%

Toward Effective Tool-Integrated Reasoning via Self-Evolved Preference Learning

Yifei Chen, Guanting Dong, Zhicheng Dou

机构 * Renmin University of China(中国人民大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11843 2025-10-01 cs.CL cs.AI 81%

Preemptive Detection and Correction of Misaligned Actions in LLM Agents

Haishuo Fang, Xiaodan Zhu, Iryna Gurevych

机构 * Ubiquitous Knowledge Processing Lab, Department of Computer Science, TU Darmstadt(图宾根大学计算机科学系) National Research Center for Applied Cybersecurity ATHENE, Germany(德国应用网络安全国家研究中心ATHENE) Department of Electrical and Computer Engineering & Ingenuity Labs Research Institute, Queen’s University, Canada(加拿大女王大学电气与计算机工程系及创新实验室研究院)

专题命中 推理与问题求解 :LLM(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25794 2025-10-01 cs.CV cs.AI 79%

Point-It-Out: Benchmarking Embodied Reasoning for Vision Language Models in Multi-Stage Visual Grounding

Haotian Xue, Yunhao Ge, Yu Zeng, Zhaoshuo Li, Ming-Yu Liu, Yongxin Chen, Jiaojiao Fan

机构 * Georgia Tech(佐治亚理工学院) NVIDIA(英伟达)

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26417 2025-10-01 cs.AI cs.LG 79%

OntoAligner Meets Knowledge Graph Embedding Aligners

Hamed Babaei Giglou, Jennifer D'Souza, Sören Auer, Mahsa Sanaei

机构 * TIB -- Leibniz Information Centre for Science and Technology(莱比锡信息科学与技术研究中心) University of Tabriz(塔布里兹大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages of main content, 3 page references, 3 figures. Accepted to Ontology Matching Workshop at ISWC

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25543 2025-10-01 cs.CL cs.AI 79%

Aligning Multilingual Reasoning with Verifiable Semantics from a High-Resource Expert Model

Fahim Faisal, Kaiqiang Song, Song Wang, Simin Ma, Shujian Liu, Haoyun Deng, Sathish Reddy Indurthi

机构 * Zoom

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22628 2025-10-01 cs.CV cs.AI cs.LG 79%

UML-CoT: Structured Reasoning and Planning with Unified Modeling Language for Robotic Room Cleaning

Hongyu Chen, Guangrun Wang

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20328 2025-10-01 cs.LG cs.AI cs.CV cs.RO 79%

Video models are zero-shot learners and reasoners

Thaddäus Wiedemer, Yuxuan Li, Paul Vicol, Shixiang Shane Gu, Nick Matarese, Kevin Swersky, Been Kim, Priyank Jaini, Robert Geirhos

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments Project page: https://video-zero-shot.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15865 2025-10-01 cs.CV 78%

How Do Large Vision-Language Models See Text in Image? Unveiling the Distinctive Role of OCR Heads

Ingeol Baek, Hwan Chang, Sunghyun Ryu, Hwanhee Lee

专题命中 推理与问题求解 :language model(title,abstract)

Comments EMNLP 2025 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14142 2025-10-01 cs.SD eess.AS 78%

AudSemThinker: Enhancing Audio-Language Models through Reasoning over Semantics of Sound

Gijs Wijngaard, Elia Formisano, Michele Esposito, Michel Dumontier

机构 * Maastricht University(马斯特里赫特大学)

专题命中 推理与问题求解 :language model(title,abstract)

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12686 2025-10-01 cs.LG cs.PL cs.SE 77%

Understanding Formal Reasoning Failures in LLMs as Abstract Interpreters

Jacqueline L. Mitchell, Brian Hyeongseok Kim, Chenyu Zhou, Chao Wang

机构 * University of Southern California(南加州大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16953 2025-10-01 cs.CL 77%

Aristotle: Mastering Logical Reasoning with A Logic-Complete Decompose-Search-Resolve Framework

Jundong Xu, Hao Fei, Meng Luo, Qian Liu, Liangming Pan, William Yang Wang, Preslav Nakov, Mong-Li Lee, Wynne Hsu

机构 * National University of Singapore(国立新加坡大学) University of Auckland(奥克兰大学) University of Arizona(亚利桑那大学) University of California, Santa Barbara(加州大学圣芭芭拉分校) MBZUAI

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ACL 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03015 2025-10-01 cs.RO 75%

AuDeRe: Automated Strategy Decision and Realization in Robot Planning and Control via LLMs

Yue Meng, Fei Chen, Yongchao Chen, Chuchu Fan

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 8 pages, 14 figures, submitted to the 2026 American Control Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25534 2025-10-01 cs.CL cs.AI cs.LG 75%

Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning

Zhiling Ye, Yun Yue, Haowen Wang, Xudong Han, Jiadi Jiang, Cheng Wei, Lei Fan, Jiaxin Liang, Shuowen Zhang, Ji Li, Chunxiao Guo, Jian Wang, Peng Wei, Jinjie Gu

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25502 2025-10-01 cs.CV 75%

Seeing Before Reasoning: A Unified Framework for Generalizable and Explainable Fake Image Detection

Kaiqing Lin, Zhiyuan Yan, Ruoxin Chen, Junyan Ye, Ke-Yue Zhang, Yue Zhou, Peng Jin, Bin Li, Taiping Yao, Shouhong Ding

机构 * Guangdong Provincial Key Laboratory of Intelligent Information Processing, Shenzhen Key Laboratory of Media Security, and SZU-AFS Joint Innovation Center for AI Technology(广东省智能信息处理重点实验室、深圳媒体安全重点实验室及深圳大学-AFS联合人工智能技术创新中心) Tencent Youtu Lab(腾讯优图实验室) Peking University(北京大学) Sun Yat-Sen University(中山大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25420 2025-10-01 cs.AI cs.CL cs.LG 75%

Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search

Yingqian Cui, Zhenwei Dai, Pengfei He, Bing He, Hui Liu, Xianfeng Tang, Jingying Zeng, Suhang Wang, Yue Xing, Jiliang Tang, Benoit Dumoulin

机构 * Michigan State University(密歇根州立大学) Amazon(亚马逊) Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏