arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-11 至 2025-09-11 共收录 110 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 8 篇

2509.07730 2025-09-11 cs.CL 88%

M-BRe: Discovering Training Samples for Relation Extraction from Unlabeled Texts with Large Language Models

Zexuan Li, Hongliang Dai, Piji Li

机构 * College of Artificial Intelligence, Nanjing University of Aeronautics and Astronautics(人工智能学院,南京航空航天大学) MIIT Key Laboratory of Pattern Analysis and Machine Intelligence(信息产业部模式分析与机器智能重点实验室) The Key Laboratory of Brain-Machine Intelligence Technology, Ministry of Education(脑机智能技术重点实验室,教育部)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by EMNLP2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08416 2025-09-11 cs.AR 85%

AutoVeriFix: Automatically Correcting Errors and Enhancing Functional Correctness in LLM-Generated Verilog Code

Yan Tan, Xiangchen Meng, Zijun Jiang, Yangdi Lyu

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03682 2025-09-11 cs.LG cs.AI 84%

Self-Questioning Language Models

Lili Chen, Mihir Prabhudesai, Katerina Fragkiadaki, Hao Liu, Deepak Pathak

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 预训练与数据 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08490 2025-09-11 cs.CV cs.AI 79%

A Structured Review of Underwater Object Detection Challenges and Solutions: From Traditional to Large Vision Language Models

Edwine Nabahirwa, Wei Song, Minghua Zhang, Yi Fang, Zhou Ni

机构 * Shanghai Ocean University(上海海洋大学)

专题命中 预训练与数据 :language model(title,abstract);分类 cs.AI

Comments 72 Pages, 11 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08586 2025-09-11 eess.IV cs.CV 71%

CNN-ViT Hybrid for Pneumonia Detection: Theory and Empiric on Limited Data without Pretraining

Prashant Singh Basnet, Roshan Chitrakar

机构 * The British College, Keele University(凯利大学英国学院) Nepal College of Information Technology, Pokhara University(尼泊尔信息技术学院,波克拉大学)

专题命中 预训练与数据 :pretraining(title)

Comments 8 pages, 5 Tables, 5 Figures. Manuscript submitted to ICOIICS 2025 Conference. Currently, under peer review

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12330 2025-09-11 cs.LG 57%

MAX: Masked Autoencoder for X-ray Fluorescence in Geological Investigation

An-Sheng Lee, Yu-Wen Pao, Hsuan-Tien Lin, Sofia Ya Hsuan Liou

机构 * Department of Geosciences and Research Center for Future Earth National Taiwan University(地质学系及未来地球研究中心 国立台湾大学)

专题命中 预训练与数据 :foundation model(abstract);分类 cs.LG

Journal ref JGR: Machine Learning and Computation, 2 (2025), e2025JH000754

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08724 2025-09-11 cs.SE 50%

SWE-Mirror: Scaling Issue-Resolving Datasets by Mirroring Issues Across Repositories

Junhao Wang, Daoguang Zan, Shulin Xin, Siyao Liu, Yurong Wu, Kai Shen

专题命中 预训练与数据 :post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08519 2025-09-11 cs.CV cs.MM 50%

HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning

Liyang Chen, Tianxiang Ma, Jiawei Liu, Bingchuan Li, Zhuowei Chen, Lijie Liu, Xu He, Gen Li, Qian He, Zhiyong Wu

机构 * Tsinghua University(清华大学) Intelligent Creation Lab, ByteDance(字节跳动智能创作实验室)

专题命中 预训练与数据 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 6 篇

2509.08755 2025-09-11 cs.LG cs.AI cs.CL 85%

AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning

Zhiheng Xi, Jixuan Huang, Chenyang Liao, Baodai Huang, Honglin Guo, Jiaqi Liu, Rui Zheng, Junjie Ye, Jiazheng Zhang, Wenxiang Chen, Wei He, Yiwen Ding, Guanyu Li, Zehui Chen, Zhengyin Du, Xuesong Yao, Yufei Xu, Jiecao Chen, Tao Gui, Zuxuan Wu, Qi Zhang, Xuanjing Huang, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 指令微调 :LLM(title,abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments preprint, 39 pages, 16 figures. Project: https://AgentGym-RL.github.io/. Framework and Code: https://github.com/woooodyy/AgentGym, https://github.com/woooodyy/AgentGym-RL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08000 2025-09-11 cs.CL 81%

AntiDote: Bi-level Adversarial Training for Tamper-Resistant LLMs

Debdeep Sanyal, Manodeep Ray, Murari Mandal

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10160 2025-09-11 cs.CV cs.AI 79%

PriorCLIP: Visual Prior Guided Vision-Language Model for Remote Sensing Image-Text Retrieval

Jiancheng Pan, Muyuan Ma, Qing Ma, Cong Bai, Shengyong Chen

机构 * IEEE Publication Technology Department(IEEE出版技术部)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08381 2025-09-11 cs.CL cs.AI 73%

Low-Resource Fine-Tuning for Multi-Task Structured Information Extraction with a Billion-Parameter Instruction-Tuned Model

Yu Cheng Chih, Yong Hao Hou

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 13 pages, 8 figures, includes experiments on JSON extraction, knowledge graph extraction, and NER

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14157 2025-09-11 cs.CL cs.AI 62%

Prior Prompt Engineering for Reinforcement Fine-Tuning

Pittawat Taveekitworachai, Potsawee Manakul, Sarana Nutanong, Kunat Pipatanakul

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP 2025, Main; 26 pages, 42 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16531 2025-09-11 cs.LG 57%

HOFT: Householder Orthogonal Fine-tuning

Alejandro Moreno Arcas, Albert Sanchis, Jorge Civera, Alfons Juan

机构 * MLLP group, Valencian Research Institute for Artificial Intelligence(瓦伦西亚人工智能研究 institute 的 MLLP 组) Universitat Politècnica de València, Spain(瓦伦西亚理工大学,西班牙)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 后训练与偏好优化 4 篇

2509.08329 2025-09-11 cs.LG cs.AI 90%

Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing

Lukas Toral, Teddy Lazebnik

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00419 2025-09-11 cs.CR cs.SE 89%

Teaching an Old LLM Secure Coding: Localized Preference Optimization on Distilled Preferences

Mohammad Saqib Hasan, Saikat Chakraborty, Santu Karmaker, Niranjan Balasubramanian

专题命中 后训练与偏好优化 :LLM(title,abstract);preference optimization(title,abstract);prompting(abstract)

Comments Accepted to ACL 2025 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08500 2025-09-11 cs.AI 85%

TCPO: Thought-Centric Preference Optimization for Effective Embodied Decision-making

Kechen Jiao, Zhirui Fang, Jiahao Liu, Bei Li, Qifan Wang, Xinyu Liu, Junhao Ruan, Zhongjian Qiao, Yifan Zhu, Yaxin Xu, Jingang Wang, Xiu Li

机构 * Tsinghua University(清华大学) Meituan(美团) Northeastern University(东北大学) Beijing University of Posts and Telecommunications(北京邮电大学) Meta AI Wuhan University(武汉大学)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);language model(abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06887 2025-09-11 cs.IR 50%

UniSearch: Rethinking Search System with a Unified Generative Architecture

Jiahui Chen, Xiaoze Jiang, Zhibo Wang, Quanzhi Zhu, Junyao Zhao, Feng Hu, Kang Pan, Ao Xie, Maohua Pei, Zhiheng Qin, Hongjing Zhang, Zhixin Zhai, Xiaobo Guo, Runbin Zhou, Kefeng Wang, Mingyang Geng, Cheng Chen, Jingshan Lv, Yupeng Huang, Xiao Liang, Han Li

专题命中 后训练与偏好优化 :preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 长上下文与记忆 2 篇

2509.08596 2025-09-11 cs.CL 85%

LLM Ensemble for RAG: Role of Context Length in Zero-Shot Question Answering for BioASQ Challenge

Dima Galat, Diego Molla-Aliod

机构 * University of Technology Sydney (UTS), Australia(悉尼技术大学(UTS))

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments CEUR-WS, CLEF2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.14581 2025-09-11 cs.MM eess.IV 50%

Memory-Anchored Multimodal Reasoning for Explainable Video Forensics

Chen Chen, Runze Li, Zejun Zhang, Pukun Zhao, Fanqing Zhou, Longxiang Wang, Haojian Huang

专题命中 长上下文与记忆 :pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 推理与问题求解 17 篇

2504.13534 2025-09-11 cs.CL cs.AI 91%

CoT-RAG: Integrating Chain of Thought and Retrieval-Augmented Generation to Enhance Reasoning in Large Language Models

Feiyang Li, Peng Fang, Zhan Shi, Arijit Khan, Fang Wang, Weihao Wang, Xin Zhang, Yongjian Cui

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology, Wuhan, China(华中科技大学计算机科学与技术学院) Wuhan National Laboratory for Optoelectronics, Huazhong University of Science and Technology, Wuhan, China(华中科技大学光电实验室) Department of Computer Science, Bowling Green State University, Ohio, USA(Bowling Green State University 计算机科学系) Department of Computer Science, Aalborg University, Aalborg, Denmark(Aalborg University 计算机科学系) Huawei Technologies Co., Ltd, Shenzhen, China(华为技术有限公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02682 2025-09-11 cs.CL cs.AI cs.LG 87%

MPO: Boosting LLM Agents with Meta Plan Optimization

Weimin Xiong, Yifan Song, Qingxiu Dong, Bingchan Zhao, Feifan Song, Xun Wang, Sujian Li

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08646 2025-09-11 cs.CR cs.AI cs.SY eess.SY 85%

Architecting Resilient LLM Agents: A Guide to Secure Plan-then-Execute Implementations

Ron F. Del Rosario, Klaudia Krawiecka, Christian Schroeder de Witt

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08407 2025-09-11 physics.med-ph cs.AI 85%

An Iterative LLM Framework for SIBT utilizing RAG-based Adaptive Weight Optimization

Zhuo Xiao, Qinglong Yao, Jingjing Wang, Fugen Zhou, Bo Liu, Haitao Sun, Zhe Ji, Yuliang Jiang, Junjie Wang, Qiuwen Wu

机构 * Image Processing Center, Beihang University(北航图像处理中心) Department of Radiation Oncology, Peking University Third Hospital(北京大学第三医院放射肿瘤科) Department of Radiation Oncology, Duke University Medical Center(杜克大学医学中心放射肿瘤科)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06037 2025-09-11 cs.LG 85%

Investigating Compositional Reasoning in Time Series Foundation Models

Willa Potosnak, Cristian Challu, Mononito Goswami, Kin G. Olivares, Michał Wiliński, Nina Żukowska, Artur Dubrawski

机构 * Auton Lab, School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系自动化实验室) Nixtla Amazon(亚马逊)

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16654 2025-09-11 cs.CV 85%

MSNav: Zero-Shot Vision-and-Language Navigation with Dynamic Memory and LLM Spatial Reasoning

Chenghao Liu, Zhimu Zhou, Jiachen Zhang, Minghao Zhang, Songfang Huang, Huiling Duan

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08270 2025-09-11 cs.LG cs.AI 81%

Interpretable Physics Reasoning and Performance Taxonomy in Vision-Language Models

Pranav Pawar, Kavish Shah, Akshat Bhalani, Komal Kasat, Dev Mittal, Hadi Gala, Deepali Patil, Nikita Raichada, Monali Deshmukh

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08785 2025-09-11 cs.AI cs.MA stat.ML 79%

Narrative-Guided Reinforcement Learning: A Platform for Studying Language Model Influence on Decision Making

Anup Tuladhar, Araz Minhas, Adam Kirton, Eli Kinney-Lang

专题命中 推理与问题求解 :language model(title,abstract);分类 cs.AI

Comments Extended Abstract for RLDM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08803 2025-09-11 cs.SI cs.AI cs.CL cs.CY 79%

Scaling Truth: The Confidence Paradox in AI Fact-Checking

Ihsan A. Qazi, Zohaib Khan, Abdullah Ghani, Agha A. Raza, Zafar A. Qazi, Wassay Sajjad, Ayesha Ali, Asher Javaid, Muhammad Abdullah Sohail, Abdul H. Azeemi

专题命中 推理与问题求解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments 65 pages, 26 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15108 2025-09-11 cs.LG cs.AI cs.RO 79%

VIPER: Visual Perception and Explainable Reasoning for Sequential Decision-Making

Mohamed Salim Aissi, Clemence Grislain, Mohamed Chetouani, Olivier Sigaud, Laure Soulier, Nicolas Thome

机构 * Sorbonne Université, CNRS, ISIR(索邦大学、国家科学研究中心、ISIR)

专题命中 推理与问题求解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏