arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11714 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11714 篇

2505.16475 2025-05-23 cs.AI 77%

ReflectEvo: Improving Meta Introspection of Small LLMs by Learning Self-Reflection

Jiaqi Li, Xinyi Dong, Yang Liu, Zhizhuo Yang, Quansen Wang, Xiaobo Wang, SongChun Zhu, Zixia Jia, Zilong Zheng

机构 * State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,BIGAI)

专题命中 指令微调 :language model(abstract);small language model(abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11269 2025-05-20 cs.CL 77%

Can MLLMs Generalize to Multi-Party dialog? Exploring Multilingual Response Generation in Complex Scenarios

Zhongtian Hu, Yiwen Cui, Ronghan Li, Meng Zhao, Lifang Wang

机构 * School of Computer Science and Engineering, Northwestern Polytechnical University(计算机科学与工程学院,西北工业大学) School of Computer Science and Technology, Xidian University(计算机科学与技术学院,西安电子科技大学) School of Artificial Intelligence and Big Data, Henan University of Technology(人工智能与大数据学院,河南工业大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11266 2025-05-20 cs.CL 77%

VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs

Keer Lu, Keshi Zhao, Zhuoran Zhang, Zheng Liang, Da Pan, Shusen Zhang, Xin Wu, Guosheng Dong, Bin Cui, Tengjiao Wang, Wentao Zhang

机构 * Center for Data Science, Academy for Advanced Interdisciplinary Studies, Peking University(数据科学中心、先进跨学科研究院、北京大学) School of CS & Key Lab of High Confidence Software Technologies (MOE), Peking University(计算机学院及高可信软件技术实验室(教育部)) Baichuan Inc.(百川科技公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05327 2025-05-20 cs.CL 77%

RICo: Refined In-Context Contribution for Automatic Instruction-Tuning Data Selection

Yixin Yang, Qingxiu Dong, Linli Yao, Fangwei Zhu, Zhifang Sui

机构 * State Key Laboratory of Multimedia Information Processing(多媒体信息处理国家重点实验室) Peking University(北京大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10497 2025-05-14 cs.IR cs.AI cs.HC cs.MA cs.SY eess.SY 77%

Exploring Generative AI Techniques in Government: A Case Study

Sunyi Liu, Mengzhe Geng, Rebecca Hart

机构 * University of Toronto(多伦多大学) National Research Council of Canada(加拿大国家研究理事会)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments In submission to IEEE Intelligent Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09798 2025-05-13 cs.CR cs.CL 77%

Fun-tuning: Characterizing the Vulnerability of Proprietary LLMs to Optimization-based Prompt Injection Attacks via the Fine-Tuning Interface

Andrey Labunets, Nishit V. Pandya, Ashish Hooda, Xiaohan Fu, Earlence Fernandes

机构 * UC San Diego(加州大学圣地亚哥分校) University of Wisconsin Madison(威斯康星大学麦迪逊分校)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref Proceedings of the 2025 IEEE Symposium on Security and Privacy, IEEE Computer Society, 2025, pp. 374-392

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09701 2025-05-13 cs.CL 77%

Bridging the Language Gap: Enhancing Multilingual Prompt-Based Code Generation in LLMs via Zero-Shot Cross-Lingual Transfer

Mingda Li, Abhijit Mishra, Utkarsh Mujumdar

机构 * Department of Statistics and Data Science, Yale University(耶鲁大学统计与数据科学系) School of Information, University of Texas at Austin(德克萨斯大学奥斯汀分校信息学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted and to appear in IJCNN 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10424 2025-05-13 cs.PL cs.AI 77%

CodeV: Empowering LLMs with HDL Generation through Multi-Level Summarization

Yang Zhao, Di Huang, Chongxiao Li, Pengwei Jin, Muxin Song, Yinan Xu, Ziyuan Nan, Mingju Gao, Tianyun Ma, Lei Qi, Yansong Pan, Zhenxing Zhang, Rui Zhang, Xishan Zhang, Zidong Du, Qi Guo, Xing Hu

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所处理器重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Cambricon Technologies(寒武科技) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院) University of Science and Technology of China(中国科学技术大学) Shanghai Innovation Center for Processor Technologies(上海处理器技术创新中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 13 pages, 10 figures, journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03059 2025-05-07 cs.CL 77%

Improving Model Alignment Through Collective Intelligence of Open-Source LLMS

Junlin Wang, Roy Xie, Shang Zhu, Jue Wang, Ben Athiwaratkun, Bhuwan Dhingra, Shuaiwen Leon Song, Ce Zhang, James Zou

机构 * Duke University(杜克大学) Together AI University of Chicago(芝加哥大学) Stanford University(斯坦福大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15210 2025-05-06 cs.SE cs.AI 77%

Integrating Symbolic Execution into the Fine-Tuning of Code-Generating LLMs

Marina Sakharova, Abhinav Anand, Mira Mezini

机构 * TU Darmstadt(图宾根大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18580 2025-04-29 cs.LG 77%

Parameter-Efficient Checkpoint Merging via Metrics-Weighted Averaging

Shi Jie Yu, Sehyun Choi

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.01705 2025-04-01 cs.CR cs.CL 77%

Data Extraction Attacks in Retrieval-Augmented Generation via Backdoors

Yuefeng Peng, Junda Wang, Hong Yu, Amir Houmansadr

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16081 2025-03-31 cs.LG cs.IR 77%

OThink-MR1: Stimulating multimodal generalized reasoning capabilities via dynamic reinforcement learning

Zhiyuan Liu, Yuting Zhang, Feng Liu, Changwang Zhang, Ying Sun, Jun Wang

机构 * OPPO Research Institute(OPPO研究院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16236 2025-03-17 stat.ML cs.LG 77%

A transfer learning framework for weak-to-strong generalization

Seamus Somerstep, Felipe Maia Polo, Moulinath Banerjee, Ya'acov Ritov, Mikhail Yurochkin, Yuekai Sun

机构 * University of Michigan(密歇根大学) IBM Research(IBM研究院) MIT-IBM Watson AI Lab(麻省理工学院-IBM沃森人工智能实验室)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments v2: Major changes to set up, theory, and experiments v3: Camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02875 2025-03-05 cs.CL 77%

The First Few Tokens Are All You Need: An Efficient and Effective Unsupervised Prefix Fine-Tuning Method for Reasoning Models

Ke Ji, Jiahao Xu, Tian Liang, Qiuzhi Liu, Zhiwei He, Xingyu Chen, Xiaoyuan Liu, Zhijie Wang, Junying Chen, Benyou Wang, Zhaopeng Tu, Haitao Mi, Dong Yu

机构 * Tencent AI Lab(腾讯AI实验室)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14434 2025-03-04 cs.CL 77%

Selected Languages are All You Need for Cross-lingual Truthfulness Transfer

Weihao Liu, Ning Wu, Wenbiao Ding, Shining Liang, Ming Gong, Dongmei Zhang

机构 * Microsoft STC Asia(微软亚洲技术中心)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments 16 pages, COLING2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08694 2025-03-04 cs.CL 77%

TeaMs-RL: Teaching LLMs to Generate Better Instruction Datasets via Reinforcement Learning

Shangding Gu, Alois Knoll, Ming Jin

机构 * UC Berkeley(加州大学伯克利分校) Technical University of Munich(慕尼黑工业大学) Virginia Tech(弗吉尼亚理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10245 2025-02-26 cs.CL 77%

From Text to Emoji: How PEFT-Driven Personality Manipulation Unleashes the Emoji Potential in LLMs

Navya Jain, Zekun Wu, Cristian Munoz, Airlie Hilliard, Xin Guan, Adriano Koshiyama, Emre Kazim, Philip Treleaven

机构 * Holistic AI(霍利斯提克人工智能公司) University College London(伦敦大学学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Findings paper of NAACL 2025 and NeurIPS 2024 Workshop on Behavioral Machine Learning

Journal ref Findings paper of NAACL 2025 and NeurIPS 2024 Workshop on Behavioral Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08656 2025-02-25 cs.CL 77%

LLMs Are Biased Towards Output Formats! Systematically Evaluating and Mitigating Output Format Bias of LLMs

Do Xuan Long, Hai Nguyen Ngoc, Tiviatis Sim, Hieu Dao, Shafiq Joty, Kenji Kawaguchi, Nancy F. Chen, Min-Yen Kan

机构 * National University of Singapore(新加坡国立大学) VinAI Research(VinAI研究院) Institute of High Performance Computing (IHPC), A*STAR(新加坡科技研究局高性能计算研究所) Salesforce Research(Salesforce研究院) Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments NAACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13148 2025-02-25 cs.LG cs.CR 77%

Defending Jailbreak Prompts via In-Context Adversarial Game

Yujun Zhou, Yufei Han, Haomin Zhuang, Kehan Guo, Zhenwen Liang, Hongyan Bao, Xiangliang Zhang

机构 * University of Notre Dame(圣母大学) INRIA(法国国家信息与自动化研究所) King Abdullah University of Science and Technology(阿卜杜拉国王科技大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments EMNLP 2024 Main Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15233 2025-02-24 cs.CR cs.CL 77%

A General Pseudonymization Framework for Cloud-Based LLMs: Replacing Privacy Information in Controlled Text Generation

Shilong Hou, Ruilin Shang, Zi Long, Xianghua Fu, Yin Chen

机构 * College of Application and Technology, Shenzhen University(深圳大学应用技术学院) College of Big Data and Internet, Shenzhen Technology University(深圳技术大学大数据与互联网学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12478 2025-02-19 cs.CL 77%

MSE-Adapter: A Lightweight Plugin Endowing LLMs with the Capability to Perform Multimodal Sentiment Analysis and Emotion Recognition

Yang Yang, Xunde Dong, Yupeng Qiang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04524 2025-02-18 cs.CL 77%

Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning

Yanrui Du, Sendong Zhao, Jiawei Cao, Ming Ma, Danyang Zhao, Shuren Qi, Fenglei Fan, Ting Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12566 2025-02-18 cs.CL 77%

RichRAG: Crafting Rich Responses for Multi-faceted Queries in Retrieval-Augmented Generation

Shuting Wang, Xin Yu, Mang Wang, Weipeng Chen, Yutao Zhu, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Baichuan Intelligent Technology(百川智能科技)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Journal ref https://aclanthology.org/volumes/2025.coling-main/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10739 2025-02-18 cs.CL 77%

BASE-SQL: A powerful open source Text-To-SQL baseline approach

Lei Sheng, Shuai-Shuai Xu, Wei Xie

机构 * Wuhan University of Technology(武汉理工大学) University of Science and Technology of China(中国科学技术大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments Work in progress. 16 pages, 3 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09002 2025-02-14 cs.LG 77%

End-to-End triplet loss based fine-tuning for network embedding in effective PII detection

Rishika Kohli, Shaifu Gupta, Manoj Singh Gaur

机构 * Indian Institute of Technology Jammu(贾姆穆印度理工学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 13 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.19702 2025-02-13 cs.CV cs.AI cs.MM 77%

TimeSuite: Improving MLLMs for Long Video Understanding via Grounded Tuning

Xiangyu Zeng, Kunchang Li, Chenting Wang, Xinhao Li, Tianxiang Jiang, Ziang Yan, Songze Li, Yansong Shi, Zhengrong Yue, Yi Wang, Yali Wang, Yu Qiao, Limin Wang

机构 * Nanjing University(南京大学) Shanghai AI Laboratory(上海人工智能实验室) SIAT, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI

Comments Accepted by ICLR2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05006 2025-02-13 cs.SE cs.AI 77%

COAST: Enhancing the Code Debugging Ability of LLMs through Communicative Agent Based Data Synthesis

Weiqing Yang, Hanbin Wang, Zhenghao Liu, Xinze Li, Yukun Yan, Shuo Wang, Yu Gu, Minghe Yu, Zhiyuan Liu, Ge Yu

机构 * Northeastern University(东北大学) Peking University(北京大学) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08037 2025-02-13 cs.CL 77%

Franken-Adapter: Cross-Lingual Adaptation of LLMs by Embedding Surgery

Fan Jiang, Honglin Yu, Grace Chung, Trevor Cohn

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07544 2025-02-12 cs.CL 77%

Grammar Control in Dialogue Response Generation for Language Learning Chatbots

Dominik Glandorf, Peng Cui, Detmar Meurers, Mrinmaya Sachan

机构 * EPFL(洛桑联邦理工学院) University of Tübingen(蒂宾根大学) ETH Zürich(苏黎世联邦理工学院) Leibniz-Institut für Wissensmedien(莱布尼茨知识媒体研究所)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments Accepted to NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏