arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11619 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11619 篇

2510.03577 2025-10-07 cs.CL cs.IR 90%

LLM, Reporting In! Medical Information Extraction Across Prompting, Fine-tuning and Post-correction

Ikram Belmadani, Parisa Nazari Hashemi, Thomas Sebbag, Benoit Favre, Guillaume Fortier, Solen Quiniou, Emmanuel Morin, Richard Dufour

机构 * Nantes Université, École Centrale Nantes, CNRS, LS2N, UMR 6004(南特大学、中央理工大学、CNRS、LS2N、UMR 6004) Aix-Marseille Université, CNRS, LIS UMR 7020(阿维尼翁-马赛大学、CNRS、LIS UMR 7020) Explore, Carquefou, France(Explore公司、Carquefou,法国) Inetum, 93400 Saint-Ouen-sur-Seine, France(Inetum公司、93400 Saint-Ouen-sur-Seine,法国)

专题命中 指令微调 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments in French language

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16865 2025-09-24 cs.AI 90%

Large Language Models as End-to-end Combinatorial Optimization Solvers

Xia Jiang, Yaoxin Wu, Minshuo Li, Zhiguang Cao, Yingqian Zhang

机构 * Eindhoven University of Technology(埃因霍温理工大学) Singapore Management University(新加坡管理学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Journal ref The 39th Annual Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17439 2025-09-23 cs.SE cs.AI cs.DC cs.OS 90%

Large Language Models as Realistic Microservice Trace Generators

Donghyun Kim, Sriram Ravula, Taemin Ha, Alexandros G. Dimakis, Daehyeok Kim, Aditya Akella

机构 * University of Texas at Austin(德克萨斯大学奥斯汀分校) University of California, Berkeley(加州大学伯克利分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12140 2025-08-29 cs.CL 90%

Multilingual Contextualization of Large Language Models for Document-Level Machine Translation

Miguel Moura Ramos, Patrick Fernandes, Sweta Agrawal, André F. T. Martins

机构 * Instituto Superior Técnico, Universidade de Lisboa (ELLIS Unit Lisbon)(里斯本大学理工学院(ELLIS单位里斯本)) Instituto de Telecomunicações(电信研究所) Carnegie Mellon University(卡内基梅隆大学) Unbabel

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11779 2025-08-28 cs.CL 90%

Efficient Response Generation Strategy Selection for Fine-Tuning Large Language Models Through Self-Aligned Perplexity

Xuan Ren, Qi Chen, Lingqiao Liu

机构 * University of Adelaide(阿德莱德大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07959 2025-08-26 cs.SE cs.AI 90%

Source Code Summarization in the Era of Large Language Models

Weisong Sun, Yun Miao, Yuekang Li, Hongyu Zhang, Chunrong Fang, Yi Liu, Gelei Deng, Yang Liu, Zhenyu Chen

机构 * College of Computing and Data Science, Nanyang Technological University Singapore(计算与数据科学学院,新加坡南洋理工大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Computer Science and Engineering, University of New South Wales(计算机科学与工程学院,新南威尔士大学) School of Big Data and Software Engineering, Chongqing University(大数据与软件工程学院,重庆大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments Accepted to the 47th International Conference on Software Engineering (ICSE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15182 2025-08-22 cs.LG 90%

SafeLLM: Unlearning Harmful Outputs from Large Language Models against Jailbreak Attacks

Xiangman Li, Xiaodong Wu, Qi Li, Jianbing Ni, Rongxing Lu

机构 * Department of Electrical and Computer Engineering, Queen’s University(电气与计算机工程系,皇后大学) School of Computing, Queen’s University(计算机学院,皇后大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24773 2025-08-21 cs.LG 90%

AFLoRA: Adaptive Federated Fine-Tuning of Large Language Models with Resource-Aware Low-Rank Adaption

Yajie Zhou, Xiaoyi Pang, Zhibo Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08836 2025-08-13 cs.CR cs.AI 90%

EditMF: Drawing an Invisible Fingerprint for Your Large Language Models

Jiaxuan Wu, Yinghan Zhou, Wanli Peng, Yiming Xue, Juan Wen, Ping Zhong

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01233 2025-07-31 cs.AI 90%

Best Practices for Large Language Models in Radiology

Christian Bluethgen, Dave Van Veen, Cyril Zakka, Katherine Link, Aaron Fanous, Roxana Daneshjou, Thomas Frauenfelder, Curtis Langlotz, Sergios Gatidis, Akshay Chaudhari

机构 * Stanford Center for Artificial Intelligence in Medicine and Imaging(斯坦福大学人工智能医学与成像中心) Diagnostic and Interventional Radiology, University Hospital Zurich, University of Zurich(苏黎世大学医院放射诊断与介入放射学) Department of Electrical Engineering, Stanford University(斯坦福大学电气工程系) Department of Cardiothoracic Surgery, Stanford Medicine(斯坦福医学院心胸外科系) Hugging Face Department of Medical Education, Icahn School of Medicine at Mount Sinai(伊坎医学院Mount Sinai医学教育系) NVIDIA Corporation(NVIDIA公司) UT Health San Antonio(UT健康科学中心圣安东尼奥分校) Department of Dermatology, Redwood City, CA, USA(红木城加州大学皮肤病学系) Department of Biomedical Data Science, Stanford, CA, USA(斯坦福大学生物医学数据科学系) Department of Medicine, Stanford, CA, USA(斯坦福大学医学系) Department of Radiology, Stanford University(斯坦福大学放射学系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments A redacted version of this preprint has been accepted for publication in Radiology

Journal ref Radiology 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10972 2025-07-16 cs.CL cs.CV cs.MM 90%

Teach Me Sign: Stepwise Prompting LLM for Sign Language Production

Zhaoyi An, Rei Kawakami

机构 * Institute of Science Tokyo(东京科学研究所)

专题命中 指令微调 :LLM(title,abstract);prompting(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by IEEE ICIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10098 2025-07-15 cs.CL 90%

Fusing Large Language Models with Temporal Transformers for Time Series Forecasting

Chen Su, Yuanhe Tian, Qinyu Liu, Jun Zhang, Yan Song

机构 * University of Science and Technology of China(中国科学技术大学) University of Washington(华盛顿大学) Beijing Northern Computility InterConnection Co., Ltd.(北京北方计算互联有限公司) ENN Group Co., Ltd.(ENN集团有限公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08151 2025-07-14 cs.CL 90%

Distilling Empathy from Large Language Models

Henry J. Xie, Jinghan Zhang, Xinhao Zhang, Kunpeng Liu

机构 * Westview High School(西弗尼高中) Portland State University(波特兰州立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SLM(abstract);prompting(abstract)

Comments Accepted by SIGDIAL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04063 2025-06-05 cs.HC cs.DC cs.LG 90%

Crowd-SFT: Crowdsourcing for LLM Alignment

Alex Sotiropoulos, Sulyab Thottungal Valapu, Linus Lei, Jared Coleman, Bhaskar Krishnamachari

专题命中 指令微调 :SFT(title,abstract);LLM(title);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16672 2025-06-04 cs.AI 90%

The Tug of War Within: Mitigating the Fairness-Privacy Conflicts in Large Language Models

Chen Qian, Dongrui Liu, Jie Zhang, Yong Liu, Jing Shao

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04407 2025-05-27 cs.CL 90%

Lens: Rethinking Multilingual Enhancement for Large Language Models

Weixiang Zhao, Yulin Hu, Jiahe Guo, Xingyu Sui, Tongtong Wu, Yang Deng, Yanyan Zhao, Bing Qin, Wanxiang Che, Ting Liu

机构 * Harbin Institute of Technology(哈尔滨理工大学) Monash University(墨尔本大学) Singapore Management University(新加坡管理大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);post-training(abstract)

Comments 23 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12470 2025-05-26 cs.AI 90%

NeuroGen: Neural Network Parameter Generation via Large Language Models

Jiaqi Wang, Yusen Zhang, Xi Li

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Auburn University(阿肯色大学欧文市)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

Comments The three authors contributed equally to this work. The codes will be public after being accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06738 2025-05-23 cs.CL 90%

EntGPT: Entity Linking with Generative Large Language Models

Yifan Ding, Amrit Poudel, Qingkai Zeng, Tim Weninger, Balaji Veeramani, Sanmitra Bhattacharya

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14297 2025-05-21 cs.CL 90%

Cross-Lingual Optimization for Language Transfer in Large Language Models

Jungseob Lee, Seongtae Hong, Hyeonseok Moon, Heuiseok Lim

机构 * Korea University(韩国大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments Accepted for publication at ACL 2025. Jungseob Lee and Seongtae Hong contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06245 2025-05-21 cs.CL 90%

A Comparative Study of Learning Paradigms in Large Language Models via Intrinsic Dimension

Saahith Janapati, Yangfeng Ji

机构 * University of Virginia(弗吉尼亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11441 2025-05-20 cs.LG 90%

D3: Diversity, Difficulty, and Dependability-Aware Data Selection for Sample-Efficient LLM Instruction Tuning

Jia Zhang, Chen-Xi Zhang, Yao Liu, Yi-Xuan Jin, Xiao-Wen Yang, Bo Zheng, Yi Liu, Lan-Zhe Guo

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) School of Artificial Intelligence, Nanjing University(南京大学人工智能学院) Algorithm Tech, Taobao & Tmall Group of Alibaba(阿里巴巴集团算法技术部) School of Intelligence Science and Technology, Nanjing University(南京大学智能科学与技术学院)

专题命中 指令微调 :LLM(title,abstract);instruction tuning(title,abstract);large language model(abstract);language model(abstract)

Comments IJCAI'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04785 2025-05-06 cs.CL cs.CY 90%

Mapping Trustworthiness in Large Language Models: A Bibliometric Analysis Bridging Theory to Practice

José Siqueira de Cerqueira, Kai-Kristian Kemell, Rebekah Rousi, Nannan Xi, Juho Hamari, Pekka Abrahamsson

机构 * Tampere University(塔尔基耶大学) University of Vaasa(瓦萨大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18296 2025-04-01 cs.CL 90%

Surgical Action Planning with Large Language Models

Mengya Xu, Zhongzhen Huang, Jie Zhang, Xiaofan Zhang, Qi Dou

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments 10 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09029 2025-03-13 cs.CL 90%

DAST: Difficulty-Aware Self-Training on Large Language Models

Boyang Xue, Qi Zhu, Hongru Wang, Rui Wang, Sheng Wang, Hongling Xu, Fei Mi, Yasheng Wang, Lifeng Shang, Qun Liu, Kam-Fai Wong

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04870 2025-03-11 physics.comp-ph cond-mat.mtrl-sci cs.LG 90%

Leveraging Large Language Models to Address Data Scarcity in Machine Learning: Applications in Graphene Synthesis

Devi Dutta Biswajeet, Sara Kadkhodaei

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments 20 pages, 10 figures, 4 tables; Supplementary Material with 13 figures and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05867 2025-02-11 cs.CL 90%

Self-Training Large Language Models for Tool-Use Without Demonstrations

Ne Luo, Aryo Pradipta Gema, Xuanli He, Emile van Krieken, Pietro Lesci, Pasquale Minervini

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17485 2025-02-10 cs.CL eess.AS 90%

VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning

Yifan Peng, Krishna C. Puvvada, Zhehuai Chen, Piotr Zelasko, He Huang, Kunal Dhawan, Ke Hu, Shinji Watanabe, Jagadeesh Balam, Boris Ginsburg

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

Comments Accepted at NAACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09698 2025-01-14 cs.IR cs.AI 90%

Harnessing Multimodal Large Language Models for Multimodal Sequential Recommendation

Yuyang Ye, Zhi Zheng, Yishan Shen, Tianshu Wang, Hengruo Zhang, Peijun Zhu, Runlong Yu, Kai Zhang, Hui Xiong

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.01399 2025-01-07 cs.CL 90%

Developing Safe and Responsible Large Language Model : Can We Balance Bias Reduction and Language Understanding in Large Language Models?

Shaina Raza, Oluwanifemi Bamgbose, Shardul Ghuge, Fatemeh Tavakol, Deepak John Reji, Syed Raza Bashir

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08747 2025-01-07 cs.CL 90%

An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning

Yun Luo, Zhen Yang, Fandong Meng, Yafu Li, Jie Zhou, Yue Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏