arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18875 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18875 篇

2509.00529 2025-10-10 cs.CL cs.CY 85%

Modeling Motivated Reasoning in Law: Evaluating Strategic Role Conditioning in LLM Summarization

Eunjung Cho, Alexander Hoyle, Yoan Hermstrüwer

机构 * ETH Zurich(苏黎世联邦理工学院) University of Zurich(苏黎世大学) Max Planck Institute for Research on Collective Goods(集体利益研究所)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at NLLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11885 2025-10-10 cs.CL 85%

Med-R$^2$: Crafting Trustworthy LLM Physicians via Retrieval and Reasoning of Evidence-Based Medicine

Keer Lu, Zheng Liang, Da Pan, Shusen Zhang, Guosheng Dong, Zhonghai Wu, Huang Leng, Bin Cui, Wentao Zhang

机构 * Center for Data Science, AAIS Peking University Beijing China(数据科学中心,北京大学北京中国) Baichuan Inc. Beijing China(北川公司北京中国) School of Computer Science Peking University Beijing China(计算机科学学院,北京大学北京中国) Peking University(北京大学) Baichuan Inc.(北川公司)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06994 2025-10-09 cs.CR cs.CL 85%

RedTWIZ: Diverse LLM Red Teaming via Adaptive Attack Planning

Artur Horal, Daniel Pina, Henrique Paz, Iago Paulo, João Soares, Rafael Ferreira, Diogo Tavares, Diogo Glória-Silva, João Magalhães, David Semedo

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01713 2025-10-07 cs.CL 85%

SRPO: Enhancing Multimodal LLM Reasoning via Reflection-Aware Reinforcement Learning

Zhongwei Wan, Zhihao Dou, Che Liu, Yu Zhang, Dongfei Cui, Qinjian Zhao, Hui Shen, Jing Xiong, Yi Xin, Yifan Jiang, Chaofan Tao, Yangfan He, Mi Zhang, Shen Yan

机构 * The Ohio State University(俄亥俄州立大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01069 2025-10-02 cs.AI 85%

Typed Chain-of-Thought: A Curry-Howard Framework for Verifying LLM Reasoning

Elija Perrier

机构 * Centre for Quantum Software and Information(量子软件与信息中心) University of Technology Sydney(悉尼技术大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23652 2025-10-02 cs.CV cs.AI 85%

ReWatch-R1: Boosting Complex Video Reasoning in Large Vision-Language Models through Agentic Data Synthesis

Congzhi Zhang, Zhibin Wang, Yinchao Ma, Jiawei Peng, Yihan Wang, Qiang Zhou, Jun Song, Bo Zheng

机构 * Alibaba Group(阿里巴巴集团)

专题命中 推理与问题求解 :language model(title,abstract);post-training(abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10197 2025-10-02 cs.AI 85%

MathConstruct: Challenging LLM Reasoning with Constructive Proofs

Mislav Balunović, Jasper Dekoninck, Nikola Jovanović, Ivo Petrov, Martin Vechev

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) INSAIT, Sofia University "St. Kliment Ohridski"(索菲亚大学"圣克莱孟·欧里斯基"学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04325 2025-10-02 cs.CL 85%

Language Models can Subtly Deceive Without Lying: A Case Study on Strategic Phrasing in Legislation

Atharvan Dogra, Krishna Pillutla, Ameet Deshpande, Ananya B Sai, John Nay, Tanmay Rajpurohit, Ashwin Kalyan, Balaraman Ravindran

机构 * Centre for Responsible AI, IIT Madras(IIT马德拉斯责任人工智能中心) Indian Institute of Technology Madras(印度马德拉斯理工学院) Princeton University(普林斯顿大学) Stanford University(斯坦福大学)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments 24 pages, 7 figures; published in Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025), Volume 1: Long Papers; Anthology ID 2025.acl-long.1600

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), Vienna, Austria, July 2025, pages 33367-33390

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04215 2025-10-02 cs.AI 85%

NL2Plan: Robust LLM-Driven Planning from Minimal Text Descriptions

Elliot Gestrin, Marco Kuhlmann, Jendrik Seipp

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted for the ICAPS 2024 Workshop on Human-Aware and Explainable Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25885 2025-10-01 cs.AI 85%

SafeMind: Benchmarking and Mitigating Safety Risks in Embodied LLM Agents

Ruolin Chen, Yinqian Sun, Jihang Wang, Mingyang Lv, Qian Zhang, Yi Zeng

机构 * Brain-inspired Cognitive AI Lab, Institute of Automation, Chinese Academy of Sciences(脑启发认知AI实验室,自动化研究所,中国科学院) Beijing Key Laboratory of Safe AI and Superalignment(北京安全AI与超对齐关键实验室) Beijing Institute of AI Safety and Governance(北京AI安全与治理研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Long-term AI(长期AI)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01245 2025-10-01 cs.AI cs.MA cs.OS 85%

Towards Agentic OS: An LLM Agent Framework for Linux Schedulers

Yusheng Zheng, Yanpeng Hu, Wei Zhang, Andi Quinn

机构 * UC Santa Cruz, CA, USA(加州大学圣克ruz分校) University of Connecticut(康涅狄格大学) ShanghaiTech University(上海科技大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref MLforSystem 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24957 2025-09-30 cs.LG 85%

Intra-request branch orchestration for efficient LLM reasoning

Weifan Jiang, Rana Shahout, Yilun Du, Michael Mitzenmacher, Minlan Yu

机构 * Harvard University(哈佛大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24217 2025-09-30 cs.CL 85%

Semi-structured LLM Reasoners Can Be Rigorously Audited

Jixuan Leng, Cassandra A. Cohen, Zhixian Zhang, Chenyan Xiong, William W. Cohen

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22834 2025-09-30 cs.NI cs.AI 85%

Bridging Language Models and Formal Methods for Intent-Driven Optical Network Design

Anis Bekri, Amar Abane, Abdella Battou, Saddek Bensalem

机构 * National Institute of Standards and Technology(美国国家标准技术研究院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments Accepted at AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00089 2025-09-30 cs.CY cs.AI 85%

TRAPDOC: Deceiving LLM Users by Injecting Imperceptible Phantom Tokens into Documents

Hyundong Jin, Sicheol Sung, Shinwoo Park, SeungYeop Baik, Yo-Sub Han

机构 * Yonsei University(延世大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20988 2025-09-29 cs.AI q-bio.QM 85%

AOT*: Efficient Synthesis Planning via LLM-Empowered AND-OR Tree Search

Xiaozhuang Song, Xuanhao Pan, Xinjian Zhao, Hangting Ye, Shufei Zhang, Jian Tang, Tianshu Yu

机构 * School of Data Science, CUHK-Shenzhen(CUHK-Shenzhen数据科学学院) Shanghai AI Laboratory(上海人工智能实验室) Jilin University(吉林大学) Mila - Quebec AI Institute(魁北克AI研究所) HEC Montréal(蒙特利尔HEC)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 34 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08413 2025-09-29 cs.CL 85%

Labeling Free-text Data using Language Model Ensembles

Jiaxing Qiu, Dongliang Guo, Natalie Papini, Noelle Peace, Hannah F. Fitterman-Harris, Cheri A. Levinson, Tom Hartvigsen, Teague R. Henry

机构 * University of Virginia, School of Data Science(弗吉尼亚大学数据科学学院) Northern Arizona University, College of Health and Human Services(北亚利桑那大学健康与人类服务学院) University of Louisville, Department of Psychology and Brain Sciences(路易斯维尔大学心理学与脑科学系) University of Virginia, Department of Psychology(弗吉尼亚大学心理学系)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21011 2025-09-26 cs.CR cs.AI cs.SE 85%

Automatic Red Teaming LLM-based Agents with Model Context Protocol Tools

Ping He, Changjiang Li, Binbin Zhao, Tianyu Du, Shouling Ji

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) Palo Alto Networks(帕洛阿尔托网络公司) School of Software Technology, Zhejiang University(浙江大学软件技术学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20499 2025-09-26 cs.RO cs.AI 85%

Boosting Zero-Shot VLN via Abstract Obstacle Map-Based Waypoint Prediction with TopoGraph-and-VisitInfo-Aware Prompting

Boqi Li, Siyuan Li, Weiyi Wang, Anran Li, Zhong Cao, Henry X. Liu

专题命中 推理与问题求解 :prompting(title);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19533 2025-09-25 cs.SE cs.AI cs.CR 85%

Semantic-Aware Fuzzing: An Empirical Framework for LLM-Guided, Reasoning-Driven Input Mutation

Mengdi Lu, Steven Ding, Furkan Alaca, Philippe Charland

机构 * School of Computing, Queen’s University(女王大学计算机学院) McGill University(麦吉尔大学) Defence R&D Canada(国防研发加拿大)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18719 2025-09-24 cs.LG 85%

LLM-Enhanced Self-Evolving Reinforcement Learning for Multi-Step E-Commerce Payment Fraud Risk Detection

Bo Qu, Zhurong Wang, Daisuke Yagi, Zhen Xu, Yang Zhao, Yinan Shan, Frank Zahradnik

机构 * eBay University of Chicago(芝加哥大学) Etsy

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 12 pages, 12 figures, ACL 2025 industry track

Journal ref In Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 6: Industry Track), pages 92-103, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14834 2025-09-22 cs.CL 85%

LLM Agents at the Roundtable: A Multi-Perspective and Dialectical Reasoning Framework for Essay Scoring

Jinhee Jang, Ayoung Moon, Minkyoung Jung, YoungBin Kim, Seung Jin Lee

机构 * NC AI Chung-Ang University

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02534 2025-09-22 cs.CL 85%

Adaptive Self-improvement LLM Agentic System for ML Library Development

Genghan Zhang, Weixin Liang, Olivia Hsu, Kunle Olukotun

机构 * Department of Computer Science, Stanford University, USA(计算机科学系,斯坦福大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03455 2025-09-22 cs.AI cs.SE 85%

Watson: A Cognitive Observability Framework for the Reasoning of LLM-Powered Agents

Benjamin Rombaut, Sogol Masoumzadeh, Kirill Vasilevski, Dayi Lin, Ahmed E. Hassan

机构 * Centre for Software Excellence, Huawei Canada(华为加拿大卓越软件中心) Queen's University, Kingston, Canada(皇后大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06304 2025-09-19 cs.CL 85%

FG-PRM: Fine-grained Hallucination Detection and Mitigation in Language Model Mathematical Reasoning

Ruosen Li, Ziming Luo, Xinya Du

机构 * Department of Computer Science, University of Texas at Dallas(德克萨斯大学达拉斯分校计算机科学系) Department of Electrical Engineering Computer Science, University of Michigen(密歇根大学电子工程与计算机科学系)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

Comments Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11176 2025-09-18 cs.CL 85%

LogiDynamics: Unraveling the Dynamics of Inductive, Abductive and Deductive Logical Inferences in LLM Reasoning

Tianshi Zheng, Jiayang Cheng, Chunyang Li, Haochen Shi, Zihao Wang, Jiaxin Bai, Yangqiu Song, Ginny Y. Wong, Simon See

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13131 2025-09-17 cs.AI 85%

Reasoning with Preference Constraints: A Benchmark for Language Models in Many-to-One Matching Markets

Marylou Fauchard, Florian Carichon, Margarida Carvalho, Golnoosh Farnadi

机构 * Université de Montréal(蒙特利尔大学) Mila McGill(麦吉尔大学)

专题命中 推理与问题求解 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12611 2025-09-17 cs.AI 85%

Analogy-Driven Financial Chain-of-Thought (AD-FCoT): A Prompting Approach for Financial Sentiment Analysis

Anmol Singhal Navya Singhal

机构 * New York University(纽约大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 推理与问题求解 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments IEEE AIxB 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15444 2025-09-17 cs.CL 85%

Cutting Through the Noise: Boosting LLM Performance on Math Word Problems

Ujjwala Anantheswaran, Himanshu Gupta, Kevin Scaria, Shreyas Verma, Chitta Baral, Swaroop Mishra

机构 * Arizona State University(亚利桑那州立大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

Comments Published at ICLR 2025 Workshop on Reasoning and Planning for LLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17573 2025-09-16 cs.CL 85%

Humanizing Machines: Rethinking LLM Anthropomorphism Through a Multi-Level Framework of Design

Yunze Xiao, Lynnette Hui Xian Ng, Jiarui Liu, Mona T. Diab

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in EMNLP main proceedings; Updated citations

详情

展开后加载摘要…

URL PDF HTML 收藏