arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-13 至 2025-10-13 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 19 篇

2510.09400 2025-10-13 cs.SE 91%

TIT: A Tree-Structured Instruction Tuning Approach for LLM-Based Code Translation

He Jiang, Yufu Wang, Hao Lin, Peiyu Zou, Zhide Zhou, Ang Jia, Xiaochen Li, Zhilei Ren

专题命中 指令微调 :LLM(title,abstract);instruction tuning(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08620 2025-10-13 cs.CL 89%

JAI-1: A Thai-Centric Large Language Model

Attapol T. Rutherford, Jullajak Karnjanaekarin, Narongkorn Panitsrisit, Pontakorn Trakuekul, Sumana Sumanakul, Natchanon Pollertlam

机构 * Jasmine Technology Solution, Thailand Department of Linguistics, Chulalongkorn University, Thailand(语言学系,朱拉隆功大学)

专题命中 指令微调 :language model(title,abstract);large language model(title);LLM(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06212 2025-10-13 cs.CL cs.CR 89%

Privacy-Preserving Parameter-Efficient Fine-Tuning for Large Language Model Services

Yansong Li, Zhixing Tan, Paula Branco, Yang Liu

机构 * University of Ottawa(渥太华大学) Zhongguancun Laboratory(中关村实验室) School of Electrical Engineering and Computer Science(电气工程与计算机科学学院) Department of Computer Science and Technology(计算机科学与技术系) Institute for AI Industry Research (AIR)(人工智能产业研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Journal ref IEEE Transactions on Audio, Speech, and Language Processing 33 (2025) 4085-4097

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08902 2025-10-13 cs.CL cs.AI 88%

A Unified Biomedical Named Entity Recognition Framework with Large Language Models

Tengxiao Lv, Ling Luo, Juntao Li, Yanhua Wang, Yuchen Pan, Chao Liu, Yanan Wang, Yan Jiang, Huiyi Lv, Yuanyuan Sun, Jian Wang, Hongfei Lin

机构 * College of Computer Science and Technology, Dalian University of Technology(大连理工大学计算机科学与技术学院) Air Force Communications NCO Academy(空军通信NCO学院) Department of Pharmacy, Second Affiliated Hospital of Dalian Medical University(大连医科大学第二附属医院药学部)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted as a short paper at BIBM2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06944 2025-10-13 cs.LG cs.AI cs.CL cs.CV 88%

AMFT: Aligning LLM Reasoners by Meta-Learning the Optimal Imitation-Exploration Balance

Lixuan He, Jie Feng, Yong Li

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments The paper is currently under investigation regarding concerns of potential academic misconduct. While the investigation is ongoing, the authors have voluntarily requested to withdraw the manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03683 2025-10-13 cs.CL 88%

Fine-Tuning Large Language Models with QLoRA for Offensive Language Detection in Roman Urdu-English Code-Mixed Text

Nisar Hussain, Amna Qasim, Gull Mehak, Muhammad Zain, Momina Hafeez, Grigori Sidorov

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 25 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19078 2025-10-13 cs.DC cs.AI 88%

Federated Fine-Tuning of Sparsely-Activated Large Language Models on Resource-Constrained Devices

Fahao Chen, Jie Wan, Peng Li, Zhou Su, Dongxiao Yu

机构 * Shandong University(山东大学) Xi’an Jiaotong University(西安交通大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted by EuroSys 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09347 2025-10-13 cs.CL 87%

LLP: LLM-based Product Pricing in E-commerce

Hairu Wang, Sheng You, Qiheng Zhang, Xike Xie, Shuguang Han, Yuchen Wu, Fei Huang, Jufeng Chen

机构 * University of Science and Technology of China(中国科学技术大学) Xianyu of Alibaba(阿里巴巴闲鱼)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09030 2025-10-13 cs.CL 85%

Automated Refinement of Essay Scoring Rubrics for Language Models via Reflect-and-Revise

Keno Harada, Lui Yoshida, Takeshi Kojima, Yusuke Iwasawa, Yutaka Matsuo

机构 * The University of Tokyo(东京大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09586 2025-10-13 cs.CV 85%

Vision Language Models: A Survey of 26K Papers

Fengming Lin

机构 * School of Computer Science, The University of Manchester, Manchester, UK(曼彻斯特大学计算机科学学院)

专题命中 指令微调 :language model(title);LLM(abstract,comments);instruction tuning(abstract);prompting(abstract)

Comments VLM/LLM Learning Notes

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20582 2025-10-13 cs.IR 83%

SUMMA: A Multimodal Large Language Model for Advertisement Summarization

Weitao Jia, Shuo Yin, Zhoufutu Wen, Han Wang, Zehui Dai, Kun Zhang, Zhenyu Li, Tao Zeng, Xiaohui Lv

专题命中 指令微调 :large language model(title);language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17131 2025-10-13 cs.LG cs.AI 82%

Enabling Self-Improving Agents to Learn at Test Time With Human-In-The-Loop Guidance

Yufei He, Ruoyu Li, Alex Chen, Yue Liu, Yulin Chen, Yuan Sui, Cheng Chen, Yi Zhu, Luca Luo, Frank Yang, Bryan Hooi

机构 * National University of Singapore(新加坡国立大学) ByteDance Inc.(字节跳动公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04503 2025-10-13 cs.CR cs.AI cs.CL 79%

P2P: A Poison-to-Poison Remedy for Reliable Backdoor Defense in LLMs

Shuai Zhao, Xinyi Wu, Shiqian Zhao, Xiaobao Wu, Zhongliang Guo, Yanhao Jia, Anh Tuan Luu

机构 * Nanyang Technological University, Singapore(南洋理工大学) Shanghai Jiao Tong University, Shanghai, China(上海交通大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08616 2025-10-13 cs.CL 72%

LLMs Show Surface-Form Brittleness Under Paraphrase Stress Tests

Juan Miguel Navarro Carranza

机构 * Stanford University(斯坦福大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL;LLM(comments)

Comments NeurIPS 2025 Workshop. Evaluating the Evolving LLM Lifecycle: Benchmarks, Emergent Abilities, and Scaling. Selected for contributed talk

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15087 2025-10-13 cs.LG 70%

Adaptive LoRA Experts Allocation and Selection for Federated Fine-Tuning

Lei Wang, Jieming Bian, Letian Zhang, Jie Xu

机构 * University of Florida(佛罗里达大学) Middle Tennessee State University(中田纳西州立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05901 2025-10-13 cs.LG cs.AI cs.CL 67%

Untangling Component Imbalance in Hybrid Linear Attention Conversion Methods

Martin Benfeghoul, Teresa Delgado, Adnan Oomerjee, Haitham Bou Ammar, Jun Wang, Zafeirios Fountas

机构 * Huawei, Noah’s Ark Lab(华为、诺亚实验室) AI Centre, Department of Computer Science, University College London(人工智能中心、计算机科学系、伦敦大学学院)

专题命中 指令微调 :post-training(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20179 2025-10-13 cs.CL cs.AI cs.RO 66%

Robo-Instruct: Simulator-Augmented Instruction Alignment For Finetuning Code LLMs

Zichao Hu, Junyi Jessy Li, Arjun Guha, Joydeep Biswas

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI;language model(comments)

Comments Conference on Language Modeling (COLM) 2025, Project site: https://amrl.cs.utexas.edu/robo-instruct/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12269 2025-10-13 cs.CV cs.AI cs.LG 62%

Site-Level Fine-Tuning with Progressive Layer Freezing: Towards Robust Prediction of Bronchopulmonary Dysplasia from Day-1 Chest Radiographs in Extremely Preterm Infants

Sybelle Goedicke-Fritz, Michelle Bous, Annika Engel, Matthias Flotho, Pascal Hirsch, Hannah Wittig, Dino Milanovic, Dominik Mohr, Mathias Kaspar, Sogand Nemat, Dorothea Kerner, Arno Bücker, Andreas Keller, Sascha Meyer, Michael Zemlin, Philipp Flotho

专题命中 指令微调 :pretraining(abstract);分类 cs.AI、cs.LG

Comments S.G.-F., M.B., and A.E. contributed equally to this work and share first authorship. M.Z. and P.F. contributed equally to this work and share senior authorship

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09049 2025-10-13 cs.AI cs.SE 57%

MEC$^3$O: Multi-Expert Consensus for Code Time Complexity Prediction

Joonghyuk Hahn, Soohan Lim, Yo-Sub Han

机构 * Department of Computer Science, Yonsei University(延世大学计算机科学系)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

Comments 24 pages, 11 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏