arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-30 至 2025-09-30 共收录 512 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 28 篇

2509.25048 2025-09-30 cs.CL 81%

Confidence-Guided Error Correction for Disordered Speech Recognition

Abner Hernandez, Tomás Arias Vergara, Andreas Maier, Paula Andrea Pérez-Toro

机构 * Pattern Recognition Lab, Friedrich-Alexander-Universität Erlangen-Nürnberg, Germany(模式识别实验室,弗里德里希-亚历山大-亚琛-纽伦堡大学,德国) GITA Lab. Facultad de Ingeniería. Universidad de Antioquia UdeA, Medellín, Colombia(GITA实验室,工程学院,安蒂奎亚大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Preprint submitted to ICASSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08440 2025-09-30 cs.RO cs.AI 81%

TGRPO :Fine-tuning Vision-Language-Action Model via Trajectory-wise Group Relative Policy Optimization

Zengjue Chen, Runliang Niu, He Kong, Qi Wang, Qianli Xing, Zipei Fan

机构 * School of Artificial Intelligence, Jilin University(人工智能学院,吉林大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22906 2025-09-30 cs.CL cs.AI 81%

Extract-0: A Specialized Language Model for Document Information Extraction

Henrique Godoy

机构 * Inteli São Paulo(Inteli圣保罗)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23893 2025-09-30 cs.LG cs.AI cs.CL cs.CR math.OC 80%

Dynamic Orthogonal Continual Fine-tuning for Mitigating Catastrophic Forgettings

Zhixin Zhang, Zeming Wei, Meng Sun

机构 * Peking University(北京大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23653 2025-09-30 cs.CL 79%

Don't Settle Too Early: Self-Reflective Remasking for Diffusion Language Models

Zemin Huang, Yuhang Wang, Zhiyang Chen, Guo-Jun Qi

机构 * Westlake University(西湖大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL

Comments 24 pages,11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03930 2025-09-30 cs.SE cs.AI cs.CL 79%

VisCoder: Fine-Tuning LLMs for Executable Python Visualization Code Generation

Yuansheng Ni, Ping Nie, Kai Zou, Xiang Yue, Wenhu Chen

机构 * University of Waterloo(滑铁卢大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25063 2025-09-30 cs.CY cs.CL 77%

Learning from Convenience Samples: A Case Study on Fine-Tuning LLMs for Survey Non-response in the German Longitudinal Election Study

Tobias Holtdirk, Dennis Assenmacher, Arnim Bleier, Claudia Wagner

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23755 2025-09-30 cs.CL cs.AI 73%

Understanding Textual Capability Degradation in Speech LLMs via Parameter Importance Analysis

Chao Wang, Rui-Chen Zheng, Yang Ai, Zhen-Hua Ling

机构 * National Engineering Research Center of Speech and Language Information Processing(语音与语言信息处理国家级工程研究中心) University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23246 2025-09-30 cs.LG cs.AI 73%

Adaptive Token-Weighted Differential Privacy for LLMs: Not All Tokens Require Equal Protection

Manjiang Yu, Priyanka Singh, Xue Li, Yang Cao

机构 * The University of Queensland(昆士兰大学) Institute of Science Tokyo(东京科学研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04153 2025-09-30 cs.CL cs.AI 73%

UltraIF: Advancing Instruction Following from the Wild

Kaikai An, Li Sheng, Ganqu Cui, Shuzheng Si, Ning Ding, Yu Cheng, Baobao Chang

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01549 2025-09-30 cs.CL cs.AI 73%

An Information Bottleneck Perspective for Effective Noise Filtering on Retrieval-Augmented Generation

Kun Zhu, Xiaocheng Feng, Xiyuan Du, Yuxuan Gu, Weijiang Yu, Haotian Wang, Qianglong Chen, Zheng Chu, Jingchang Chen, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Sun Yat-sen University(中山大学) Zhejiang University(浙江大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18450 2025-09-30 cs.CL 70%

BRIT: Bidirectional Retrieval over Unified Image-Text Graph

Ainulla Khan, Yamada Moyuru, Srinidhi Akella

机构 * Fujitsu Research India(富士通印度研究)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in EMNLP-2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12455 2025-09-30 cs.LG 70%

AltLoRA: Towards Better Gradient Approximation in Low-Rank Adaptation with Alternating Projections

Xin Yu, Yujia Wang, Jinghui Chen, Lingzhou Xue

机构 * Department of Statistics(统计学系) College of Information Sciences and Technology(信息科学与技术学院) The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23594 2025-09-30 cs.CR cs.CV 67%

StolenLoRA: Exploring LoRA Extraction Attacks via Synthetic Data

Yixu Wang, Yan Teng, Yingchun Wang, Xingjun Ma

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23595 2025-09-30 cs.CL cs.AI 62%

Timber: Training-free Instruct Model Refining with Base via Effective Rank

Taiqiang Wu, Runming Yang, Tao Liu, Jiahao Wang, Zenan Xu, Ngai Wong

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学) Tencent(腾讯)

专题命中 指令微调 :post-training(abstract);分类 cs.CL、cs.AI

Comments 7 figures, 8 tables, Working in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23781 2025-09-30 cs.CV cs.AI 57%

GroupCoOp: Group-robust Fine-tuning via Group Prompt Learning

Nayeong Kim, Seong Joon Oh, Suha Kwak

机构 * Pohang University of Science and Technology (POSTECH)(釜山科学技术大学) Tübingen AI Center(图宾根人工智能中心) Universität Tübingen(图宾根大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI

Comments This paper was first submitted to NeurIPS 2024 in May 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17608 2025-09-30 cs.LG 57%

ChartMaster: Advancing Chart-to-Code Generation with Real-World Charts and Chart Similarity Reinforcement Learning

Wentao Tan, Qiong Cao, Chao Xue, Yibing Zhan, Changxing Ding, Xiaodong He

机构 * South China University of Technology(华南理工大学) JD Future Academy(京东未来学院) Wuhan University(武汉大学)

专题命中 指令微调 :SFT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17374 2025-09-30 cs.CV cs.AI cs.IR 57%

From Drawings to Decisions: A Hybrid Vision-Language Framework for Parsing 2D Engineering Drawings into Structured Manufacturing Knowledge

Muhammad Tayyab Khan, Lequn Chen, Zane Yong, Jun Ming Tan, Wenhe Feng, Seung Ki Moon

专题命中 指令微调 :language model(abstract);分类 cs.AI

Comments Preprint submitted to Elsevier

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24698 2025-09-30 cs.CR 50%

LISA Technical Report: An Agentic Framework for Smart Contract Auditing

Izaiah Sun, Daniel Tan, Andy Deng

专题命中 指令微调 :LLM(abstract)

Comments A technical report with 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15548 2025-09-30 cs.SD 50%

Versatile Symbolic Music-for-Music Modeling via Function Alignment

Junyan Jiang, Daniel Chin, Liwei Lin, Xuanjie Liu, Gus Xia

专题命中 指令微调 :language model(abstract)

Journal ref The 26th conference of the International Society for Music Information Retrieval (ISMIR 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23861 2025-09-30 cs.IR 50%

Investigating Multi-layer Representations for Dense Passage Retrieval

Zhongbin Xie, Thomas Lukasiewicz

专题命中 指令微调 :language model(abstract)

Comments Accepted to Findings of EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 后训练与偏好优化 25 篇

2509.23024 2025-09-30 cs.LG cs.AI cs.CL 93%

Tracing the Representation Geometry of Language Models from Pretraining to Post-training

Melody Zixuan Li, Kumar Krishna Agrawal, Arna Ghosh, Komal Kumar Teru, Adam Santoro, Guillaume Lajoie, Blake A. Richards

机构 * Computer Science, McGill University(麦吉尔大学计算机科学系) Mila - Quebec AI Institute(魁北克人工智能研究所) UC Berkeley(加州大学伯克利分校) G o o g l e , Paradigms of Intelligence Team(谷歌,智能范式团队) Mathematics and Statistics, Université de Montréal(蒙特利尔大学数学与统计学系) Neurology & Neurosurgery and Montreal Neurological Institute, McGill University(神经病学与神经外科及蒙特利尔神经研究所,麦吉尔大学) CIFAR Learning in Machines & Brains Program(CIFAR 机器与大脑学习计划)

专题命中 后训练与偏好优化 :language model(title,abstract);pretraining(title,abstract);post-training(title,abstract);large language model(abstract)

Comments 33 pages, 14 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24781 2025-09-30 cs.CL 92%

SeaPO: Strategic Error Amplification for Robust Preference Optimization of Large Language Models

Jun Rao, Yunjie Liao, Xuebo Liu, Zepeng Lin, Lian Lian, Dong Jin, Shengjun Cheng, Jun Yu, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen(计算与智能学院,哈尔滨工业大学,深圳) Huawei Cloud Computing Technologies Co., Ltd.(华为云计算技术有限公司) School of Intelligence Science and Engineering, Harbin Institute of Technology, Shenzhen(智能科学与工程学院,哈尔滨工业大学,深圳)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);preference optimization(title,abstract);分类 cs.CL

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22948 2025-09-30 cs.CL cs.AI cs.CY cs.LG 91%

SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning

Tianyang Xu, Xiaoze Liu, Feijie Wu, Xiaoqian Wang, Jing Gao

机构 * Purdue University(普渡大学)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23601 2025-09-30 cs.CL cs.AI 90%

Semantic-guided Diverse Decoding for Large Language Model

Weijie Shi, Yue Cui, Yaguang Wu, Jingzhi Fang, Shibo Zhang, Mengze Li, Sirui Han, Jia Zhu, Jiajie Xu, Xiaofang Zhou

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24261 2025-09-30 cs.AI cs.LG 88%

Risk-Sensitive RL for Alleviating Exploration Dilemmas in Large Language Models

Yuhua Jiang, Jiawei Huang, Yufeng Yuan, Xin Mao, Yu Yue, Qianchuan Zhao, Lin Yan

机构 * Tsinghua University(清华大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12083 2025-09-30 cs.CV 88%

Self-alignment of Large Video Language Models with Refined Regularized Preference Optimization

Pritam Sarkar, Ali Etemad

机构 * Queen’s University(女王大学) Vector Institute(向量研究所)

专题命中 后训练与偏好优化 :language model(title,abstract);preference optimization(title,abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18126 2025-09-30 cs.LG cs.AI cs.CL 87%

Reward Model Overoptimisation in Iterated RLHF

Lorenz Wolf, Robert Kirk, Mirco Musolesi

机构 * UCL Centre for Artificial Intelligence(伦敦大学学院人工智能中心) Department of Computer Science(计算机科学系) University College London(伦敦大学学院) UK AI Security Institute(英国人工智能安全研究所) Department of Computer Science and Engineering(计算机科学与工程系) University of Bologna(博洛尼亚大学)

专题命中 后训练与偏好优化 :RLHF(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages, 17 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15845 2025-09-30 cs.CL cs.AI 86%

Coarse-to-Fine Personalized LLM Impressions for Streamlined Radiology Reports

Chengbo Sun, Hui Yi Leong, Lei Li

机构 * University of Chicago(芝加哥大学) University of Washington(华盛顿大学)

专题命中 后训练与偏好优化 :LLM(title);large language model(abstract);language model(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24491 2025-09-30 cs.CV cs.AI 85%

Mitigating Visual Hallucinations via Semantic Curriculum Preference Optimization in MLLMs

Yuanshuai Li, Yuping Yan, Junfeng Tang, Yunxuan Li, Zeqi Zheng, Yaochu Jin

机构 * School of Engineering, Westlake University, Hangzhou, China(西湖大学工程学院) School of Cyberspace Security, Nanjing University of Science and Technology, Nanjing, China(南京理工大学网络安全学院)

专题命中 后训练与偏好优化 :preference optimization(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏