arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11692 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11692 篇

2508.06103 2025-08-11 cs.CL cs.IR 87%

Few-Shot Prompting for Extractive Quranic QA with Instruction-Tuned LLMs

Mohamed Basem, Islam Oshallah, Ali Hamdi, Ammar Mohammed

机构 * Faculty of Computer Science MSA University Giza, Egypt(计算机科学学院 MSA大学 埃及吉扎) Faculty of Computer Science MSA University Egypt(计算机科学学院 MSA大学 埃及)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments 6 pages , 2 figures , Accepted in IMSA 2025,Egypt , https://imsa.msa.edu.eg/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09213 2025-07-31 cs.CL 87%

FineMedLM-o1: Enhancing Medical Knowledge Reasoning Ability of LLM from Supervised Fine-Tuning to Test-Time Training

Hongzhou Yu, Tianhao Cheng, Yingwen Wang, Wen He, Qing Wang, Ying Cheng, Yuejie Zhang, Rui Feng, Xiaobo Zhang

机构 * Fudan University(复旦大学) Children’s Hospital of Fudan University(复旦大学附属儿童医院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22703 2025-07-01 cs.SE cs.AI 87%

P4OMP: Retrieval-Augmented Prompting for OpenMP Parallelism in Serial Code

Wali Mohammad Abdullah, Azmain Kabir

机构 * Mathematics \& Information Technology Concordia University of Edmonton Edmonton, Alberta, Canada Computer Science University of Manitoba Winnipeg, Manitoba, Canada

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17211 2025-06-23 cs.LG 87%

BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning

Xuechen Zhang, Zijian Huang, Yingcong Li, Chenshun Ni, Jiasi Chen, Samet Oymak

机构 * University of Michigan(密歇根大学)

专题命中 指令微调 :SFT(title,abstract);language model(abstract);small language model(abstract);SLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09879 2025-06-23 cs.CL 87%

sPhinX: Sample Efficient Multilingual Instruction Fine-Tuning Through N-shot Guided Prompting

Sanchit Ahuja, Kumar Tanmay, Hardik Hansrajbhai Chauhan, Barun Patra, Kriti Aggarwal, Luciano Del Corro, Arindam Mitra, Tejas Indulal Dhamecha, Ahmed Awadallah, Monojit Choudhary, Vishrav Chaudhary, Sunayana Sitaram

机构 * Microsoft Corporation(微软公司) Harvard University(哈佛大学) Adobe Research(Adobe研究) MBZUAI University(MBZUAI大学) Hippocratic AI Meta AI

专题命中 指令微调 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 20 pages, 12 tables, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14012 2025-06-18 cs.CL 87%

Lost in the Mix: Evaluating LLM Understanding of Code-Switched Text

Amr Mohamed, Yang Zhang, Michalis Vazirgiannis, Guokan Shang

机构 * MBZUAI Ecole Polytechnique(巴黎高等理工学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09638 2025-06-12 cs.LG cs.CV 87%

FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models

Weiying Zheng, Ziyue Lin, Pengxin Guo, Yuyin Zhou, Feifei Wang, Liangqiong Qu

机构 * The University of Hong Kong(香港大学) UC Santa Cruz(圣克拉拉大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);foundation model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11283 2025-06-06 cs.LG 87%

AdvBDGen: Adversarially Fortified Prompt-Specific Fuzzy Backdoor Generator Against LLM Alignment

Pankayaraj Pathmanathan, Udari Madhushani Sehwag, Michael-Andrei Panaitescu-Liess, Furong Huang

机构 * University of Maryland(马里兰大学) JPMorgan AI Research(摩根大通人工智能研究) University of Maryland Capital One(马里兰大学Capital One)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)

Comments Published at the Neurips Safe Generative AI Workshop 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24768 2025-06-02 cs.CL 87%

From Macro to Micro: Probing Dataset Diversity in Language Model Fine-Tuning

Haoyu Li, Xuhong Li, Yiming Dong, Kun Liu

机构 * School of Automation, Beijing Institute of Technology(北京理工大学自动化学院) Baidu Inc.(百度公司) School of Physics, Peking University(北京大学物理学院)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20866 2025-06-02 cs.CR cs.AI cs.NI 87%

Respond to Change with Constancy: Instruction-tuning with LLM for Non-I.I.D. Network Traffic Classification

Xinjie Lin, Gang Xiong, Gaopeng Gou, Wenqi Dong, Jing Yu, Zhen Li, Wei Xia

机构 * Zhongguancun Laboratory, Beijing 100094, China(中关村实验室,北京100094,中国) Institute of Information Engineering, Chinese Academy of Sciences(信息工程研究所,中国科学院) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments IEEE Transactions on Information Forensics and Security (TIFS) camera ready, 15 pages, 6 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20771 2025-05-28 cs.IR cs.AI 87%

Bridging the Gap: Self-Optimized Fine-Tuning for LLM-based Recommender Systems

Heng Tang, Feng Liu, Xinbo Chen, Jiawei Chen, Bohao Wang, Changwang Zhang, Jun Wang, Yuegang Sun, Bingde Hu, Can Wang

机构 * Zhejiang University(浙江大学) OPPO Research Institute(OPPO研究院) South China University of Technology(华南理工大学) Intelligence Indeed(智境科技)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11617 2025-05-23 cs.SE cs.AI 87%

ASMA-Tune: Unlocking LLMs' Assembly Code Comprehension via Structural-Semantic Instruction Tuning

Xinyi Wang, Jiashui Wang, Jinbo Su, Ke Wang, Peng Chen, Yanming Liu, Long Liu, Xiang Li, Yangdong Wang, Qiyuan Chen, Rongze Chen, Chunfu Jia

机构 * Nankai University(南开大学) Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Renmin University of China(中国人民大学) University of the Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 9 pages, multiple figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03181 2025-05-07 cs.LG 87%

VLM Q-Learning: Aligning Vision-Language Models for Interactive Decision-Making

Jake Grigsby, Yuke Zhu, Michael Ryoo, Juan Carlos Niebles

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Salesforce AI Research(Salesforce人工智能研究)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

Comments SSI-FM Workshop ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02949 2025-04-07 cs.CV cs.AI 87%

VARGPT-v1.1: Improve Visual Autoregressive Large Unified Model via Iterative Instruction Tuning and Reinforcement Learning

Xianwei Zhuang, Yuxin Xie, Yufan Deng, Dongchao Yang, Liming Liang, Jinghan Ru, Yuguo Yin, Yuexian Zou

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments Code is available at: https://github.com/VARGPT-family/VARGPT-v1.1. arXiv admin note: text overlap with arXiv:2501.12327

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12152 2025-03-18 cs.CL 87%

Improving LLM-based Document-level Machine Translation with Multi-Knowledge Fusion

Bin Liu, Xinglin Lyu, Junhui Li, Daimeng Wei, Min Zhang, Shimin Tao, Hao Yang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18955 2025-03-11 cs.CL 87%

BioMistral-NLU: Towards More Generalizable Medical Language Understanding through Instruction Tuning

Yujuan Velvin Fu, Giridhar Kaushik Ramachandran, Namu Park, Kevin Lybarger, Fei Xia, Ozlem Uzuner, Meliha Yetisgen

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 3 figures an 5 tables; Accepted by AMIA 2025 Informatics Summit

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04222 2025-03-07 cs.CL 87%

FuseChat-3.0: Preference Optimization Meets Heterogeneous Model Fusion

Ziyi Yang, Fanqi Wan, Longguang Zhong, Canbin Huang, Guosheng Liang, Xiaojun Quan

专题命中 指令微调 :preference optimization(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05911 2025-02-11 cs.CL 87%

GRAIT: Gradient-Driven Refusal-Aware Instruction Tuning for Effective Hallucination Mitigation

Runchuan Zhu, Zinco Jiang, Jiang Wu, Zhipeng Ma, Jiahe Song, Fengshuo Bai, Dahua Lin, Lijun Wu, Conghui He

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments Equal contribution: Runchuan Zhu, Zinco Jiang, Jiang Wu; Corresponding author: Conghui He

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04774 2025-02-10 cs.CL 87%

SeDi-Instruct: Enhancing Alignment of Language Models through Self-Directed Instruction Generation

Jungwoo Kim, Minsang Kim, Sungjin Lee

专题命中 指令微调 :language model(title,abstract);large language model(abstract);foundation model(abstract);instruction tuning(abstract)

Comments 12 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.07012 2024-12-31 cs.CV cs.AI 87%

ProVision: Programmatically Scaling Vision-centric Instruction Data for Multimodal Language Models

Jieyu Zhang, Le Xue, Linxin Song, Jun Wang, Weikai Huang, Manli Shu, An Yan, Zixian Ma, Juan Carlos Niebles, Silvio Savarese, Caiming Xiong, Zeyuan Chen, Ranjay Krishna, Ran Xu

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);pretraining(abstract)

Comments code: https://github.com/JieyuZ2/ProVision dataset: https://huggingface.co/datasets/Salesforce/ProVision-10M

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16834 2024-12-25 cs.AI cs.GT 87%

Online Learning from Strategic Human Feedback in LLM Fine-Tuning

Shugang Hao, Lingjie Duan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06967 2024-12-11 cs.CL cs.SD eess.AS 87%

Effective Text Adaptation for LLM-based ASR through Soft Prompt Fine-Tuning

Yingyi Ma, Zhe Liu, Ozlem Kalinli

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments accepted as SLT 2024 proceeding

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03467 2024-12-05 cs.CV cs.AI 87%

Training-Free Mitigation of Language Reasoning Degradation After Multimodal Instruction Tuning

Neale Ratzlaff, Man Luo, Xin Su, Vasudev Lal, Phillip Howard

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15442 2024-11-26 cs.AR cs.AI 87%

Automatic High-quality Verilog Assertion Generation through Subtask-Focused Fine-Tuned LLMs and Iterative Prompting

Mohammad Shahidzadeh, Behnam Ghavami, Steve Wilton, Lesley Shannon

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06142 2024-11-12 cs.CV cs.AI 87%

Aquila-plus: Prompt-Driven Visual-Language Models for Pixel-Level Remote Sensing Image Understanding

Kaixuan Lu

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11801 2024-10-29 cs.CL 87%

Safety Arithmetic: A Framework for Test-time Safety Alignment of Language Models by Steering Parameters and Activations

Rima Hazra, Sayan Layek, Somnath Banerjee, Soujanya Poria

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

Comments EMNLP 2024 Main. Codes are available at: https://github.com/declare-lab/safety-arithmetic

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12917 2024-10-07 cs.LG 87%

Training Language Models to Self-Correct via Reinforcement Learning

Aviral Kumar, Vincent Zhuang, Rishabh Agarwal, Yi Su, John D Co-Reyes, Avi Singh, Kate Baumli, Shariq Iqbal, Colton Bishop, Rebecca Roelofs, Lei M Zhang, Kay McKinney, Disha Shrivastava, Cosmin Paduraru, George Tucker, Doina Precup, Feryal Behbahani, Aleksandra Faust

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14800 2024-09-24 cs.AI 87%

Choose the Final Translation from NMT and LLM hypotheses Using MBR Decoding: HW-TSC's Submission to the WMT24 General MT Shared Task

Zhanglin Wu, Daimeng Wei, Zongyao Li, Hengchao Shang, Jiaxin Guo, Shaojun Li, Zhiqiang Rao, Yuanchang Luo, Ning Xie, Hao Yang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);preference optimization(abstract)

Comments 10 pages, 4 figures, 2 Tables, EMNLP2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09345 2024-09-17 cs.AI 87%

Enhancing Decision-Making for LLM Agents via Step-Level Q-Value Models

Yuanzhao Zhai, Tingkai Yang, Kele Xu, Feng Dawei, Cheng Yang, Bo Ding, Huaimin Wang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06189 2024-07-09 cs.CV cs.AI 87%

Video-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision

Orr Zohar, Xiaohan Wang, Yonatan Bitton, Idan Szpektor, Serena Yeung-Levy

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Project page: https://orrzohar.github.io/projects/video-star/

详情

展开后加载摘要…

URL PDF HTML 收藏