arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11619 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11619 篇

2507.11939 2026-01-09 cs.CL cs.AI cs.CV cs.MM 84%

POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering

POLYCHARTQA: 通过多语言图表问答基准评估大视觉-语言模型

Yichen Xu, Liangyu Chen, Liang Zhang, Jianzhe Ma, Wenxuan Wang, Qin Jin

机构 * Renmin University of China(中国人民大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 PolyChartQA是首个大规模多语言图表问答基准,通过多语言图表生成和评估,揭示英语与其他语言在图表理解上的性能差距,并提供训练集提升多语言模型表现。

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03541 2026-01-05 cs.CL cs.AI 84%

EXAONE 3.0 7.8B Instruction Tuned Language Model

EXAONE 3.0 7.8B 指令微调语言模型

Soyoung An, Kyunghoon Bae, Eunbi Choi, Stanley Jungkyu Choi, Yemuk Choi, Seokhee Hong, Yeonjung Hong, Junwon Hwang, Hyojin Jeon, Gerrard Jeongwon Jo, Hyunjik Jo, Jiyeon Jung, Yountae Jung, Euisoon Kim, Hyosang Kim, Joonkee Kim, Seonghwan Kim, Soyeon Kim, Sunkyoung Kim, Yireun Kim, Youchul Kim, Edward Hwayoung Lee, Haeju Lee, Honglak Lee, Jinsik Lee, Kyungmin Lee, Moontae Lee, Seungjun Lee, Woohyung Lim, Sangha Park, Sooyoun Park, Yongmin Park, Boseong Seo, Sihoon Yang, Heuiyeen Yeen, Kyungjae Yoo, Hyeongu Yun

机构 * LG AI Research(LG人工智能研究)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 EXAONE 3.0 7.8B 指令微调语言模型在韩语和通用任务中表现优异,通过开源促进专家AI的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07375 2025-12-09 cs.LG cs.CL 84%

LUNE: Efficient LLM Unlearning via LoRA Fine-Tuning with Negative Examples

LUNE: 通过LoRA微调与负例实现高效的LLM反学习

Yezi Liu, Hanning Chen, Wenjun Huang, Yang Ni, Mohsen Imani

机构 * University of California, Irvine(加州大学伊藤分校) Purdue University Northwest(普渡大学西北分校)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 LUNE通过LoRA微调与负例实现高效LLM反学习,有效抑制特定知识,降低计算和内存消耗

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04518 2025-12-05 cs.CL cs.AI 84%

UW-BioNLP at ChemoTimelines 2025: Thinking, Fine-Tuning, and Dictionary-Enhanced LLM Systems for Chemotherapy Timeline Extraction

UW-BioNLP在ChemoTimelines 2025中的表现:基于思考、微调和词典增强的LLM系统用于化疗时间线提取

Tianmai M. Zhang, Zhaoyi Sun, Sihang Zeng, Chenxi Li, Neil F. Abernethy, Barbara D. Lam, Fei Xia, Meliha Yetisgen

机构 * University of Washington(华盛顿大学)

专题命中 指令微调 :LLM(title,abstract);preference optimization(abstract);分类 cs.CL、cs.AI

AI总结 UW-BioNLP通过思考、微调和词典增强LLM方法,在ChemoTimelines 2025中实现了最佳性能,提升了化疗时间线提取的准确性。

Comments To be published in Proceedings of the 7th Clinical Natural Language Processing Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00042 2025-12-02 cs.CV cs.AI cs.CL cs.CY 84%

Closing the Gap: Data-Centric Fine-Tuning of Vision Language Models for the Standardized Exam Questions

弥合差距:面向标准化考试题目的视觉语言模型数据驱动微调

Egemen Sert, Şeyda Ertekin

机构 * organization= Department of Computer Engineering, Middle East Technical University (METU) , city= Ankara , country= Türkiye organization= METU-DTX Digital Transformation \& Innovation Centre, METU , city= Ankara , country= Türkiye

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过高质量数据和优化语法提升视觉语言模型在标准化考试题目的多模态推理性能,达到接近SOTA的水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07777 2025-11-25 cs.CL cs.AI 84%

Drift No More? Context Equilibria in Multi-Turn LLM Interactions

多轮交互中不再漂移:多轮LLM交互中的上下文均衡

Vardhan Dongre, Ryan A. Rossi, Viet Dac Lai, David Seunghyun Yoon, Dilek Hakkani-Tür, Trung Bui

机构 * Adobe Research(Adobe研究院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出了一种动态框架,通过KL散度和递归模型解释多轮交互中的上下文漂移,展示可控干预能有效减少漂移,表明漂移是可控均衡现象而非必然衰减。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16375 2025-11-21 cs.LG cs.AI 84%

Are Foundation Models Useful for Bankruptcy Prediction?

基础模型在破产预测中是否有效?

Marcin Kostrzewa, Oleksii Furman, Roman Furman, Sebastian Tomczak, Maciej Zięba

机构 * wrocław University of Science and Technology(沃拉日大学科学与技术学院) Tooploox(Tooploox公司) Opera

专题命中 指令微调 :foundation model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了基础模型在破产预测中的有效性,发现传统机器学习模型在性能上优于基础模型,且基础模型在风险敏感场景中存在概率估计不可靠的问题。

Comments NeurIPS 2025 Workshop: Generative AI in Finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13052 2025-11-18 cs.LG cs.AI 84%

Learning from the Undesirable: Robust Adaptation of Language Models without Forgetting

Yunhun Nam, Jaehyung Kim, Jongheon Jeong

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.AI、cs.LG

Comments 17 pages; AAAI 2026; Code is available at https://github.com/yunpal/LfU

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06757 2025-11-11 cs.LG cs.AI 84%

Implicit Federated In-context Learning For Task-Specific LLM Fine-Tuning

Dongcheng Li, Junhan Chen, Aoxiang Zhou, Chunpei Li, Youquan Xian, Peng Liu, Xianxian Li

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24285 2025-10-29 cs.CV cs.AI cs.CL 84%

ViPER: Empowering the Self-Evolution of Visual Perception Abilities in Vision-Language Model

Juntian Zhang, Song Jin, Chuanqi Cheng, Yuhan Liu, Yankai Lin, Xun Zhang, Yufei Zhang, Fei Jiang, Guojun Yin, Wei Lin, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Meituan(美团) MBZUAI Wuhan University(武汉大学)

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22798 2025-10-28 cs.CL cs.LG 84%

VEHME: A Vision-Language Model For Evaluating Handwritten Mathematics Expressions

Thu Phuong Nguyen, Duc M. Nguyen, Hyotaek Jeon, Hyunwook Lee, Hyunmin Song, Sungahn Ko, Taehwan Kim

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2025. Project Website: https://vehme.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21885 2025-10-28 cs.CL cs.AI 84%

Preventing Catastrophic Forgetting: Behavior-Aware Sampling for Safer Language Model Fine-Tuning

Anh Pham, Mihir Thalanki, Michael Sun, Aditya Chaloo, Ankita Gupta, Tian Xia, Aditya Mate, Ehimwenma Nosakhare, Soundararajan Srinivasan

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21740 2025-10-28 cs.CV cs.AI cs.CL 84%

Diagnosing Bottlenecks in Data Visualization Understanding by Vision-Language Models

Alexa R. Tartaglini, Satchel Grant, Daniel Wurgaft, Christopher Potts, Judith E. Fan

机构 * Department of Computer Science(计算机科学系) Department of Psychology(心理学系) Department of Linguistics(语言学系) Stanford University(斯坦福大学)

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13636 2025-10-21 cs.LG cs.AI cs.GT 84%

Incentivizing Truthful Language Models via Peer Elicitation Games

Baiting Chen, Tong Zhu, Jiale Han, Lexin Li, Gang Li, Xiaowu Dai

机构 * UCLA(加州大学洛杉矶分校) UC Berkeley(伯克利大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05391 2025-10-21 cs.CL cs.AI 84%

Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences

Guillem Ramírez, Alexandra Birch, Ivan Titov

机构 * ILCC, University of Edinburgh(爱丁堡大学ILCC) ILLC, University of Amsterdam(阿姆斯特丹大学ILLC)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20999 2025-10-21 cs.LG cs.AI 84%

MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning

Yupeng Chen, Senmiao Wang, Yushun Zhang, Zhihang Lin, Haozhe Zhang, Weijian Sun, Tian Ding, Ruoyu Sun

机构 * The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)) Shenzhen Research Institute of Big Data(深圳大数据研究院) Huawei Technologies Co.,Ltd, China(华为技术有限公司) Shenzhen International Center for Industrial and Applied Mathematics(深圳国际工业与应用数学中心)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13709 2025-10-17 cs.AI cs.LG 84%

Training LLM Agents to Empower Humans

Evan Ellis, Vivek Myers, Jens Tuyls, Sergey Levine, Anca Dragan, Benjamin Eysenbach

专题命中 指令微调 :LLM(title);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13351 2025-10-16 cs.CL cs.AI 84%

Protect: Towards Robust Guardrailing Stack for Trustworthy Enterprise LLM Systems

Karthik Avinash, Nikhil Pareek, Rishav Hada

机构 * FutureAGI Inc.(未来人工智能公司)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.07146 2025-10-15 cs.LG cs.CL 84%

Attention-Aware GNN-based Input Defense against Multi-Turn LLM Jailbreak

Zixuan Huang, Kecheng Huang, Lihao Yin, Bowei He, Huiling Zhen, Mingxuan Yuan, Zili Shao

机构 * The Chinese University of Hong Kong(香港中文大学) Noah’s Ark Lab, Huawei(华为诺亚实验室) City University of Hong Kong(香港城市大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07680 2025-10-14 cs.LG cs.AI 84%

Hierarchical Balance Packing: Towards Efficient Supervised Fine-tuning for Long-Context LLM

Yongqiang Yao, Jingru Tan, Kaihuan Liang, Feizhao Zhang, Jiahao Hu, Shuo Wu, Yazhe Niu, Ruihao Gong, Dahua Lin, Ningyi Xu

机构 * Shanghai Jiao Tong University(上海交通大学) SenseTime Research(商汤科技研究院) Central South University(中南大学) The Chinese University of Hong Kong(香港中文大学) Beihang University(北京航空航天大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted in NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04481 2025-10-09 cs.CL cs.AI 84%

ECLM: Entity Level Language Model for Spoken Language Understanding with Chain of Intent

Shangjian Yin, Peijie Huang, Jiatian Chen, Haojing Huang, Yuhong Xu

机构 * College of Mathematics and Informatics, South China Agricultural University(数学与信息学学院,华南农业大学) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Published in ACL 2025

Journal ref Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (ACL 2025), pages 21851-21862

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03633 2025-10-07 cs.LG cs.AI 84%

Predicting Stock Price Movement with LLM-Enhanced Tweet Emotion Analysis

An Vuong, Susan Gauch

机构 * Department of Electrical Engineering and Computer Science, University of Arkansas(电气工程与计算机科学系,亚拉巴马大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 17th International Conference on Knowledge Discovery, Knowledge Engineering and Knowledge Management (KDIR 2025), Marbella, Spain, Oct. 22-24, 2025 (to appear) Best Student Paper Finalist

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23799 2025-10-06 cs.LG cs.AI 84%

Enhancing LLM Steering through Sparse Autoencoder-Based Vector Refinement

Anyi Wang, Xuansheng Wu, Dong Shu, Yunpu Ma, Ninghao Liu

机构 * LMU Munich(慕尼黑大学) University of Georgia(佐治亚大学) Northwestern University(西北大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) The Hong Kong Polytechnic University(香港理工大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 19 pages, 11 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01276 2025-10-03 cs.CL cs.AI 84%

LLM Based Sentiment Classification From Bangladesh E-Commerce Reviews

Sumaiya Tabassum

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12037 2025-09-29 cs.LG cs.AI 84%

Exploiting Block Coordinate Descent for Cost-Effective LLM Model Training

Zeyu Liu, Yan Li, Yunquan Zhang, Boyang Zhang, Guoyong Jiang, Xin Zhang, Limin Xiao, Weifeng Zhang, Daning Cheng

机构 * National Supercomputing Center in Taiyuan(太原国家超算中心) School of Computer Science and Technology, North University of China(中国北方大学计算机科学与技术学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Intelligent Computing Infrastructure Lab, Lenovo Research(联想研究智能计算基础设施实验室) University of the Chinese Academy of Sciences(中国科学院大学) State Key Laboratory of Integrated Service Networks, Xidian University(西安电子科技大学集成服务网络国家重点实验室) School of Advanced Interdisciplinary Sciences(高级交叉学科学院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments We have revised certain details of the manuscript and incorporated new experimental

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13222 2025-09-23 cs.CL cs.AI 84%

Can Language Models Follow Multiple Turns of Entangled Instructions?

Chi Han, Xin Liu, Haodong Wang, Shiyang Li, Jingfeng Yang, Haoming Jiang, Zhengyang Wang, Qingyu Yin, Liang Qiu, Changlong Yu, Yifan Gao, Zheng Li, Bing Yin, Jingbo Shang, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of California San Diego(加州大学圣地亚哥分校)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments The 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP 2025) Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20999 2025-09-17 cs.LG cs.CL 84%

LoRA-PAR: A Flexible Dual-System LoRA Partitioning Approach to Efficient LLM Fine-Tuning

Yining Huang, Bin Li, Keke Tang, Meilian Chen

机构 * School of Politics and Public Administration, South China Normal University(华南师范大学政治与公共管理学院) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Shenyang institute of computing technology, Chinese academy of sciences(中国科学院沈阳计算技术研究所)

专题命中 指令微调 :LLM(title,abstract);SFT(abstract);分类 cs.CL、cs.LG

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06883 2025-09-09 cs.CL cs.AI cs.IR 84%

UNH at CheckThat! 2025: Fine-tuning Vs Prompting in Claim Extraction

Joe Wilder, Nikhil Kadapala, Benji Xu, Mohammed Alsaadi, Aiden Parsons, Mitchell Rogers, Palash Agarwal, Adam Hassick, Laura Dietz

机构 * University of New Hampshire(新罕布什尔大学)

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 16 pages,3 tables, CLEF 2025 Working Notes, 9-12 September 2025, Madrid, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00046 2025-09-03 cs.LG cs.AI 84%

Exploring and Reshaping the Weight Distribution in LLM

Chunming Ye, Songzhou Li, Xu Xu

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 19 pages,16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19376 2025-08-28 cs.LG cs.AI cs.CV hep-ex 84%

Fine-Tuning Vision-Language Models for Neutrino Event Analysis in High-Energy Physics Experiments

Dikshant Sagar, Kaiwen Yu, Alejandro Yankelevich, Jianming Bian, Pierre Baldi

机构 * Department of Computer Science University of California, Irvine(计算机科学系加州大学伊文斯顿分校)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏