arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11667 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11667 篇

2510.18228 2025-10-22 cs.LG 85%

Towards Fast LLM Fine-tuning through Zeroth-Order Optimization with Projected Gradient-Aligned Perturbations

Zhendong Mi, Qitao Tan, Grace Li Zhang, Zhaozhuo Xu, Geng Yuan, Shaoyi Huang

机构 * Stevens Institute of Technology(史蒂文斯理工学院) University of Georgia(佐治亚大学) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15993 2025-10-21 q-fin.PM cs.LG q-fin.ST 85%

Aligning Language Models with Investor and Market Behavior for Financial Recommendations

Fernando Spadea, Oshani Seneviratne

机构 * Rensselaer Polytechnic Institute(拉特兰理工学院)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02569 2025-10-20 cs.CL 85%

Transcribe, Translate, or Transliterate: An Investigation of Intermediate Representations in Spoken Language Models

Tolúlopé Ògúnrèmí, Christopher D. Manning, Dan Jurafsky, Karen Livescu

机构 * Stanford University(斯坦福大学) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.CL

Comments ASRU 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14200 2025-10-17 cs.CL 85%

RLSR: Reinforcement Learning with Supervised Reward Outperforms SFT in Instruction Following

Zhichao Wang, Andy Wong, Ruslan Belkin

机构 * Inflection AI

专题命中 指令微调 :SFT(title,abstract);pretraining(abstract);RLHF(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09030 2025-10-13 cs.CL 85%

Automated Refinement of Essay Scoring Rubrics for Language Models via Reflect-and-Revise

Keno Harada, Lui Yoshida, Takeshi Kojima, Yusuke Iwasawa, Yutaka Matsuo

机构 * The University of Tokyo(东京大学)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01454 2025-10-03 cs.CV cs.LG 85%

Data Selection for Fine-tuning Vision Language Models via Cross Modal Alignment Trajectories

Nilay Naharas, Dang Nguyen, Nesihan Bulut, Mohammadhossein Bateni, Vahab Mirrokni, Baharan Mirzasoleiman

机构 * Department of Computer Science, University of California Los Angeles(加州大学洛杉矶分校计算机科学系) Google Research(谷歌研究)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);instruction tuning(abstract);分类 cs.LG

Comments 30 pages, 10 figures, 5 tables, link: https://bigml-cs-ucla.github.io/XMAS-project-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02296 2025-10-01 cs.AI 85%

Memorize or Generalize? Evaluating LLM Code Generation with Code Rewriting

Lizhe Zhang, Wentao Chen, Li Zhong, Letian Peng, Zilong Wang, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24961 2025-09-30 cs.CL 85%

SemanticShield: LLM-Powered Audits Expose Shilling Attacks in Recommender Systems

Kaihong Li, Huichi Zhou, Bin Ma, Fangjun Huang

机构 * Sun Yat-sen University(中山大学) University College London(伦敦大学学院) Qilu University of Technology(青岛科技大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20805 2025-09-26 cs.CL cs.IR 85%

Few-Shot and Training-Free Review Generation via Conversational Prompting

Genki Kusano

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.12566 2025-09-22 cs.AI 85%

Exploring the Impact of Personality Traits on LLM Bias and Toxicity

Shuo Wang, Renhao Li, Xi Chen, Yulin Yuan, Derek F. Wong, Min Yang

机构 * University of Macau(澳门大学) Shenzhen Key Laboratory for High Performance Data Mining, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳高性能数据挖掘重点实验室,深圳先进技术研究院,中国科学院) Nanyang Technological University(南洋理工大学) Department of Chinese Language and Literature, University of Macau(中文语言文学系,澳门大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14943 2025-09-19 cs.CL 85%

Explicit vs. Implicit Biographies: Evaluating and Adapting LLM Information Extraction on Wikidata-Derived Texts

Alessandra Stramiglio, Andrea Schimmenti, Valentina Pasqual, Marieke van Erp, Francesco Sovrano, Fabio Vitali

机构 * DISI Departement of Computer Science and Engineering, University of Bologna(博洛尼亚大学计算机科学与工程系) Automobili Lamborghini SpA(法拉利公司) Digital Humanities Advanced Research Center(数字人文高级研究中心) KNAW Humanities Cluster, DHLab(KNAW 人文集群,DHLab) ETH Zurich, Collegium Helveticum(苏黎世联邦理工学院,瑞士学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10943 2025-09-19 cs.LG 85%

Self-Adapting Language Models

Adam Zweiger, Jyothish Pari, Han Guo, Ekin Akyürek, Yoon Kim, Pulkit Agrawal

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.12625 2025-09-17 cs.AI 85%

ECG-aBcDe: Overcoming Model Dependence, Encoding ECG into a Universal Language for Any LLM

Yong Xia, Jingxuan Li, YeTeng Sun, Jiarui Bu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 14pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10478 2025-09-16 cs.NI cs.LG cs.SY eess.SY 85%

The LLM as a Network Operator: A Vision for Generative AI in the 6G Radio Access Network

Oluwaseyi Giwa, Michael Adewole, Tobi Awodumila, Pelumi Aderinto

机构 * African Institute for Mathematical Sciences(非洲数学科学研究所)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Submitted to Workshop on AI and ML for Next-Generation Wireless Communications and Networking, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06200 2025-09-09 cs.CL 85%

MSLEF: Multi-Segment LLM Ensemble Finetuning in Recruitment

Omar Walid, Mohamed T. Younes, Khaled Shaban, Mai Hassan, Ali Hamdi

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00731 2025-09-03 cs.CL 85%

LLM Encoder vs. Decoder: Robust Detection of Chinese AI-Generated Text with LoRA

Houji Jin, Negin Ashrafi, Armin Abdollahi, Wei Liu, Jian Wang, Ganyu Gui, Maryam Pishgar, Huanghao Feng

机构 * Suzhou University of Technology(苏州科技大学) University of Southern California(南加州大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19074 2025-08-27 cs.RO cs.AI cs.PL 85%

An LLM-powered Natural-to-Robotic Language Translation Framework with Correctness Guarantees

ZhenDong Chen, ZhanShang Nie, ShiXing Wan, JunYi Li, YongTian Cheng, Shuai Zhao

机构 * School of Computer Science and Engineering(计算机科学与工程学院) Sun Yat-Sen University(中山大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12584 2025-08-27 cs.CL 85%

Improving Multilingual Language Models by Aligning Representations through Steering

Omar Mahmoud, Buddhika Laknath Semage, Thommen George Karimpanal, Santu Rana

机构 * Applied Artificial Intelligence Initiative, Deakin University, Australia(应用人工智能计划,德肯大学,澳大利亚) School of Information Technology, Deakin University, Australia(信息技术学院,德肯大学,澳大利亚)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15854 2025-08-25 cs.CL 85%

QU-NLP at QIAS 2025 Shared Task: A Two-Phase LLM Fine-Tuning and Retrieval-Augmented Generation Approach for Islamic Inheritance Reasoning

Mohammad AL-Smadi

机构 * Qatar University(卡塔尔大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12031 2025-08-19 cs.CL 85%

Learning Wisdom from Errors: Promoting LLM's Continual Relation Learning through Exploiting Error Cases

Shaozhe Yin, Jinyu Guo, Kai Shuang, Xia Liu, Ruize Ou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) University of Electronic Science and Technology of China(电子科技大学) China National Institute of Standardization(中国标准化研究院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11889 2025-08-19 cs.CL 85%

In-Context Examples Matter: Improving Emotion Recognition in Conversation with Instruction Tuning

Hui Ma, Bo Zhang, Jinpeng Hu, Zenglin Shi

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10467 2025-08-15 cs.AI cs.DL 85%

FIRESPARQL: A LLM-based Framework for SPARQL Query Generation over Scholarly Knowledge Graphs

Xueli Pan, Victor de Boer, Jacco van Ossenbruggen

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at 17th International Joint Conference on Knowledge Discovery, Knowledge Engineering and Knowledge Management (IC3K)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07371 2025-08-12 cs.SE cs.AI 85%

AutoAssert 1: A LoRA Fine-Tuned LLM Model for Efficient Automated Assertion Generation

Yi Zhong, Hongchao Liu, Di ZHao

机构 * Institute of Computing Technology(计算技术研究所) Chinese Academy of Sciences(中国科学院) International College(国际学院) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 16pages,6figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07172 2025-08-12 cs.CL 85%

Gradient Surgery for Safe LLM Fine-Tuning

Biao Yi, Jiahao Li, Baolei Zhang, Lihai Nie, Tong Li, Tiansheng Huang, Zheli Liu

机构 * Nankai University(南开大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06765 2025-08-12 cs.LG 85%

Fed MobiLLM: Efficient Federated LLM Fine-Tuning over Heterogeneous Mobile Devices via Server Assisted Side-Tuning

Xingke Yang, Liang Li, Sicong Li, Liwei Guan, Hao Wang, Xiaoqi Qi, Jiang Liu, Xin Fu, Miao Pan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01216 2025-08-12 cs.LG cs.CR 85%

PAE MobiLLM: Privacy-Aware and Efficient LLM Fine-Tuning on the Mobile Device via Additive Side-Tuning

Xingke Yang, Liang Li, Zhiyi Wan, Sicong Li, Xiaoqi Qi, Jiang Liu, Tomoaki Ohtsuki, Xin Fu, Miao Pan

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04063 2025-08-07 cs.LG 85%

Fine-tuning for Better Few Shot Prompting: An Empirical Comparison for Short Answer Grading

Joel Walsh, Siddarth Mamidanna, Benjamin Nye, Mark Core, Daniel Auerbach

机构 * University of Southern California - Institute for Creative Technologies(南加州大学创意技术研究所) University of California, Santa Cruz(加州大学圣克鲁兹分校)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Proceedings of the Second Workshop on Automated Evaluation of Learning and Assessment Content co-located with 26th International Conference on Artificial Intelligence in Education (AIED 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16491 2025-07-30 cs.CL 85%

BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data

Wenkai Li, Jiarui Liu, Andy Liu, Xuhui Zhou, Mona Diab, Maarten Sap

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)

专题命中 指令微调 :LLM(title,abstract);preference optimization(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18812 2025-07-28 cs.SE cs.AI 85%

MemoCoder: Automated Function Synthesis using LLM-Supported Agents

Yiping Jia, Zhen Ming Jiang, Shayan Noei, Ying Zou

机构 * Queen's University(女王大学) York University(约克大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05209 2025-07-28 cs.CR cs.AI 85%

Model Tampering Attacks Enable More Rigorous Evaluations of LLM Capabilities

Zora Che, Stephen Casper, Robert Kirk, Anirudh Satheesh, Stewart Slocum, Lev E McKinney, Rohit Gandikota, Aidan Ewart, Domenic Rosati, Zichu Wu, Zikui Cai, Bilal Chughtai, Yarin Gal, Furong Huang, Dylan Hadfield-Menell

机构 * University of Maryland(马里兰大学) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) UK AI Security Institute(英国人工智能安全研究所) University of Toronto(多伦多大学) Northeastern University(东北大学) Haize Labs(Haize实验室) Dalhousie University(达尔豪斯大学) University of Waterloo(滑铁卢大学) University of Oxford(牛津大学) MIT(麻省理工学院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏