arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-07 至 2025-10-07 共收录 30 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 30 篇

2308.10792 2025-10-07 cs.CL cs.AI cs.LG 93%

Instruction Tuning for Large Language Models: A Survey

Shengyu Zhang, Linfeng Dong, Xiaoya Li, Sen Zhang, Xiaofei Sun, Shuhe Wang, Jiwei Li, Runyi Hu, Tianwei Zhang, Fei Wu, Guoyin Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);SFT(abstract)

Comments V6; Last update: AUG 11, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03577 2025-10-07 cs.CL cs.IR 90%

LLM, Reporting In! Medical Information Extraction Across Prompting, Fine-tuning and Post-correction

Ikram Belmadani, Parisa Nazari Hashemi, Thomas Sebbag, Benoit Favre, Guillaume Fortier, Solen Quiniou, Emmanuel Morin, Richard Dufour

机构 * Nantes Université, École Centrale Nantes, CNRS, LS2N, UMR 6004(南特大学、中央理工大学、CNRS、LS2N、UMR 6004) Aix-Marseille Université, CNRS, LIS UMR 7020(阿维尼翁-马赛大学、CNRS、LIS UMR 7020) Explore, Carquefou, France(Explore公司、Carquefou,法国) Inetum, 93400 Saint-Ouen-sur-Seine, France(Inetum公司、93400 Saint-Ouen-sur-Seine,法国)

专题命中 指令微调 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments in French language

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03284 2025-10-07 cs.LG cs.AI 88%

Edge-FIT: Federated Instruction Tuning of Quantized LLMs for Privacy-Preserving Smart Home Environments

Vinay Venkatesh, Vamsidhar R Kamanuru, Lav Kumar, Nikita Kothari

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04454 2025-10-07 cs.CL 84%

Mitigating Forgetting Between Supervised and Reinforcement Learning Yields Stronger Reasoners

Xiangchi Yuan, Xiang Chen, Tong Yu, Dachuan Shi, Can Jin, Wenke Lee, Saayan Mitra

机构 * Georgia Institute of Technology(佐治亚理工学院) Adobe Research(Adobe研究) Rutgers University(罗格斯大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03633 2025-10-07 cs.LG cs.AI 84%

Predicting Stock Price Movement with LLM-Enhanced Tweet Emotion Analysis

An Vuong, Susan Gauch

机构 * Department of Electrical Engineering and Computer Science, University of Arkansas(电气工程与计算机科学系,亚拉巴马大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 17th International Conference on Knowledge Discovery, Knowledge Engineering and Knowledge Management (KDIR 2025), Marbella, Spain, Oct. 22-24, 2025 (to appear) Best Student Paper Finalist

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20752 2025-10-07 cs.CV cs.AI 83%

Reason-RFT: Reinforcement Fine-Tuning for Visual Reasoning of Vision Language Models

Huajie Tan, Yuheng Ji, Xiaoshuai Hao, Xiansheng Chen, Pengwei Wang, Zhongyuan Wang, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院自动化研究所人工智能学院)

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.AI

Comments 51 pages, 23 figures, NeurIPS'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04966 2025-10-07 cs.CV cs.AI 79%

ActiveMark: on watermarking of visual foundation models via massive activations

Anna Chistyakova, Mikhail Pautov

专题命中 指令微调 :foundation model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00924 2025-10-07 cs.CL 79%

XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML

Ernesto L. Estevanell-Valladares, Suilan Estevez-Velarde, Yoan Gutiérrez, Andrés Montoyo, Ruslan Mitkov

机构 * University of Alicante(阿利坎特大学) University of Havana(哈瓦那大学) University of Lancaster(兰卡斯特大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL

Comments 18 pages, 10 figures, 7 tables. Preprint. Accepted at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05482 2025-10-07 cs.CL cs.SI 79%

HP-BERT: A framework for longitudinal study of Hinduphobia on social media via language models

Ashutosh Singh, Rohitash Chandra

机构 * Transitional Artificial Intelligence Research Group, School of Mathematics and Statistics, UNSW Sydney(过渡人工智能研究组,数学与统计学学院,UNSW悉尼) Centre for Artificial Intelligence and Innovation, Pingla Institute, Sydney, Australia(人工智能与创新中心,Pingla研究所,悉尼,澳大利亚) Department of Data Science and Artificial Intelligence, IIIT Naya Raipur(数据科学与人工智能系,IIIT奈亚拉普尔)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03691 2025-10-07 cs.LG cs.AI 79%

REG: A Regularization Optimizer for Robust Training Dynamics

Zehua Liu, Han Wu, Xiaojin Fu, Shuqi Liu, Xiongwei Han, Tao Zhong, Mingxuan Yuan

机构 * Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21947 2025-10-07 cs.LG cs.AI 79%

Active Attacks: Red-teaming LLMs via Adaptive Environments

Taeyoung Yun, Pierre-Luc St-Charles, Jinkyoo Park, Yoshua Bengio, Minsu Kim

机构 * KAIST(韩国科学技术院) Mila – Québec AI Institute(魁北克人工智能研究所) LawZero Omelet Université de Montréal(蒙特利尔大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 22 pages, 7 figures, 18 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06916 2025-10-07 cs.LG cs.AI eess.SP quant-ph 79%

QuIC: Quantum-Inspired Compound Adapters for Parameter Efficient Fine-Tuning

Snehal Raj, Brian Coyle

机构 * QC Ware(QC公司) LIP6, CNRS, Sorbonne Université(LIP6、CNRS、索邦大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 30 pages, 12 figures, 7 tables, ~8000 words

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25694 2025-10-07 cs.SD cs.AI 77%

HNote: Extending YNote with Hexadecimal Encoding for Fine-Tuning LLMs in Music Modeling

Hung-Ying Chu, Shao-Yu Wei, Guan-Wei Chen, Tzu-Wei Hung, ChengYang Tsai, Yu-Cheng Lin

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19030 2025-10-07 cs.AI 77%

RECAST: Expanding the Boundaries of LLMs' Complex Instruction Following with Multi-Constraint Data

Zhengkang Guo, Wenhao Liu, Mingchen Xie, Jingwen Xu, Zisu Huang, Muzhao Tian, Jianhan Xu, Yuanzhe Shen, Qi Qian, Muling Wu, Xiaohua Wang, Changze Lv, He-Da Wang, Hu Yao, Xiaoqing Zheng, Xuanjing Huang

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09411 2025-10-07 cs.CR 75%

LLMalMorph: On The Feasibility of Generating Variant Malware using Large-Language-Models

Md Ajwad Akil, Adrian Shuai Li, Imtiaz Karim, Arun Iyengar, Ashish Kundu, Vinny Parla, Elisa Bertino

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03270 2025-10-07 cs.LG cs.AI 73%

CoDA: Coding LM via Diffusion Adaptation

Haolin Chen, Shiyu Wang, Can Qin, Bo Pang, Zuxin Liu, Jielin Qiu, Jianguo Zhang, Yingbo Zhou, Zeyuan Chen, Ran Xu, Shelby Heinecke, Silvio Savarese, Caiming Xiong, Huan Wang, Weiran Yao

机构 * Salesforce AI Research(Salesforce人工智能研究)

专题命中 指令微调 :language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04757 2025-10-07 cs.CL q-bio.QM 70%

ModernBERT + ColBERT: Enhancing biomedical RAG through an advanced re-ranking retriever

Eduardo Martínez Rivera, Filippo Menolascina

机构 * School of Informatics University of Edinburgh(信息学院爱丁堡大学) School of Engineering University of Edinburgh(工程学院爱丁堡大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03680 2025-10-07 cs.AI 70%

Rainbow Padding: Mitigating Early Termination in Instruction-Tuned Diffusion LLMs

Bumjun Kim, Dongjae Jeon, Dueun Kim, Wonje Jeung, Albert No

机构 * Artificial Intelligence Department of Yonsei University(延世大学人工智能系) Computer Science Department of Yonsei University(延世大学计算机科学系)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 25 pages. Project page available at~\url{https://ai-isl.github.io/rainbow-padding}

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03425 2025-10-07 cs.LG 70%

Memory-Efficient Backpropagation for Fine-Tuning LLMs on Resource-Constrained Mobile Devices

Congzheng Song, Xinyu Tang

机构 * Apple(苹果公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20783 2025-10-07 cs.LG cs.AI cs.CL 67%

Understanding R1-Zero-Like Training: A Critical Perspective

Zichen Liu, Changyu Chen, Wenjun Li, Penghui Qi, Tianyu Pang, Chao Du, Wee Sun Lee, Min Lin

机构 * Sea AI Lab(海智实验室) National University of Singapore(新加坡国立大学) Singapore Management University(新加坡管理学院)

专题命中 指令微调 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03955 2025-10-07 cs.CV 67%

Harnessing Synthetic Preference Data for Enhancing Temporal Understanding of Video-LLMs

Sameep Vani, Shreyas Jena, Maitreya Patel, Chitta Baral, Somak Aditya, Yezhou Yang

机构 * Arizona State University(亚利桑那州立大学) Indian Institute of Technology, Kharagpur(印度理工学院,克拉格浦)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments 17 pages, 9 figures, 6 tables. Presents TimeWarp, a synthetic preference data framework to improve temporal understanding in Video-LLMs, showing consistent gains across seven benchmarks. Includes supplementary material in the Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03705 2025-10-07 cs.CR 67%

Backdoor-Powered Prompt Injection Attacks Nullify Defense Methods

Yulin Chen, Haoran Li, Yuan Sui, Yangqiu Song, Bryan Hooi

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05135 2025-10-07 cs.RO 67%

LERa: Replanning with Visual Feedback in Instruction Following

Svyatoslav Pchelintsev, Maxim Patratskiy, Anatoly Onishchenko, Alexandr Korchemnyi, Aleksandr Medvedev, Uliana Vinogradova, Ilya Galuzinsky, Aleksey Postnikov, Alexey K. Kovalev, Aleksandr I. Panov

机构 * MIPT(莫斯科国立交通大学) Sberbank of Russia, Robotics Center(俄罗斯储蓄银行机器人中心) AIRI

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments Accepted to IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15436 2025-10-07 cs.LG cs.AI cs.CL cs.DC 67%

Fed-SB: A Silver Bullet for Extreme Communication Efficiency and Performance in (Private) Federated LoRA Fine-Tuning

Raghav Singhal, Kaustubh Ponkshe, Rohit Vartak, Lav R. Varshney, Praneeth Vepakomma

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Duke University(杜克大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Raghav Singhal and Kaustubh Ponkshe contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04016 2025-10-07 cs.CL cs.AI 62%

Thai Semantic End-of-Turn Detection for Real-Time Voice Agents

Thanapol Popit, Natthapath Rungseesiripak, Monthol Charattrakool, Saksorn Ruangtanusak

专题命中 指令微调 :prompting(abstract);分类 cs.CL、cs.AI

Comments IEEE ICSEC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00336 2025-10-07 cs.LG cs.AI 62%

Large EEG-U-Transformer for Time-Step Level Detection Without Pre-Training

Kerui Wu, Ziyue Zhao, Bülent Yener

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03276 2025-10-07 cs.LG cs.AI 62%

QuadEnhancer: Leveraging Quadratic Transformations to Enhance Deep Neural Networks

Qian Chen, Linxin Yang, Akang Wang, Xiaodong Luo, Yin Zhang

机构 * School of Science and Engineering(科学与工程学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen International Center for Industrial and Applied Mathematics(深圳国际工业与应用数学中心) Shenzhen Research Institute of Big Data(深圳大数据研究院) School of Data Science(数据科学学院)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16965 2025-10-07 cs.CL cs.CV 57%

Praxis-VLM: Vision-Grounded Decision Making via Text-Driven Reinforcement Learning

Zhe Hu, Jing Li, Zhongzhu Pu, Hou Pong Chan, Yu Yin

机构 * The Hong Kong Polytechnic University(香港理工大学) Tsinghua University(清华大学) InspireOmni AI Alibaba Group(阿里巴巴集团) Case Western Reserve University(凯斯西储大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10849 2025-10-07 cs.RO cs.AI cs.HC cs.MA 57%

Pragmatic Embodied Spoken Instruction Following in Human-Robot Collaboration with Theory of Mind

Lance Ying, Xinyi Li, Shivam Aarya, Yizirui Fang, Yifan Yin, Jason Xinyu Liu, Stefanie Tellex, Joshua B. Tenenbaum, Tianmin Shu

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard University(哈佛大学) Johns Hopkins University(约翰霍普金斯大学) Brown University(布朗大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04706 2025-10-07 cs.CV 50%

ID-Consistent, Precise Expression Generation with Blendshape-Guided Diffusion

Foivos Paraperas Papantoniou, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国学院)

专题命中 指令微调 :foundation model(abstract)

Comments ICCVW 2025, Code: https://github.com/foivospar/Arc2Face

详情

展开后加载摘要…

URL PDF HTML 收藏