arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-10 至 2025-10-10 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 15 篇

2510.08466 2025-10-10 cs.LG 88%

In-Context Clustering with Large Language Models

Ying Wang, Mengye Ren, Andrew Gordon Wilson

机构 * New York University(纽约大学)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08191 2025-10-10 cs.CL 84%

Training-Free Group Relative Policy Optimization

Yuzheng Cai, Siqi Cai, Yuchen Shi, Zihan Xu, Lichao Chen, Yulei Qin, Xiaoyu Tan, Gang Li, Zongyi Li, Haojia Lin, Yong Mao, Ke Li, Xing Sun

机构 * Tencent(腾讯)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02011 2025-10-10 cs.CV 82%

OASIS: Online Sample Selection for Continual Visual Instruction Tuning

Minjae Lee, Minhyuk Seo, Tingyu Qu, Tinne Tuytelaars, Jonghyun Choi

机构 * Seoul National University(首尔国立大学) KU Leuven(库尔勒文大学)

专题命中 指令微调 :instruction tuning(title,abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19786 2025-10-10 cs.CL 81%

Flora: Effortless Context Construction to Arbitrary Length and Scale

Tianxiang Chen, Zhentao Tan, Xiaofan Bo, Yue Wu, Tao Gong, Qi Chu, Jieping Ye, Nenghai Yu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08149 2025-10-10 cs.CL cs.AI cs.LG 80%

AI Knowledge Assist: An Automated Approach for the Creation of Knowledge Bases for Conversational AI Agents

Md Tahmid Rahman Laskar, Julien Bouvier Tremblay, Xue-Yong Fu, Cheng Chen, Shashi Bhushan TN

机构 * Dialpad Inc.(Dialpad公司)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to the EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07835 2025-10-10 cs.LG cs.AI cs.CL cs.CR 80%

MetaDefense: Defending Finetuning-based Jailbreak Attack Before and During Generation

Weisen Jiang, Sinno Jialin Pan

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted By NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01674 2025-10-10 cs.CV 80%

MotionSight: Boosting Fine-Grained Motion Understanding in Multimodal LLMs

Yipeng Du, Tiehan Fan, Kepan Nan, Rui Xie, Penghao Zhou, Xiang Li, Jian Yang, Zhenheng Yang, Ying Tai

机构 * Nanjing University(南京大学) ByteDance(字节跳动) Nankai University(南开大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22745 2025-10-10 cs.CR cs.AI 77%

Defending MoE LLMs against Harmful Fine-Tuning via Safety Routing Alignment

Jaehan Kim, Minkyoo Song, Seungwon Shin, Sooel Son

机构 * KAIST(韩国科学技术院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19128 2025-10-10 cs.LG 77%

Personalized Federated Fine-Tuning for LLMs via Data-Driven Heterogeneous Model Architectures

Yicheng Zhang, Zhen Qin, Zhaomin Wu, Jian Hou, Shuiguang Deng

机构 * Zhejiang University(浙江大学) National University of Singapore(新加坡国立大学) Zhejiang Sci-Tech University(浙江科技学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments On going work. Codes are released at https://github.com/zyc140345/FedAMoLE

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01342 2025-10-10 cs.CR 75%

Fine-Tuning Jailbreaks under Highly Constrained Black-Box Settings: A Three-Pronged Approach

Xiangfang Li, Yu Wang, Bo Li

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02843 2025-10-10 cs.CY cs.AI cs.LG 73%

Thousands of AI Authors on the Future of AI

Katja Grace, Harlan Stewart, Julia Fabienne Sandkühler, Stephen Thomas, Ben Weinstein-Raun, Jan Brauner, Richard C. Korzekwa

机构 * AI Impacts Berkeley, California United States(伯克利加州大学) Department of Psychology University of Bonn(波恩大学心理学系) University of Bonn(波恩大学) Department of Computer Science University of Oxford(牛津大学计算机科学系) University of Oxford(牛津大学) Independent(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments The asterisk indicates the corresponding author. The dagger indicates equal contribution

Journal ref Journal of Artificial Intelligence Research 84:9 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06825 2025-10-10 cs.CL 70%

Adaptive Tool Generation with Models as Tools and Reinforcement Learning

Chenpeng Wang, Xiaojie Cheng, Chunye Wang, Linfeng Yang, Lei Zhang

机构 * Chenpeng Wang(王晨鹏) Xiaojie Cheng(程晓杰) Chunye Wang(王春业) Linfeng Yang(杨林峰) Lei Zhang(张磊)

专题命中 指令微调 :language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.05145 2025-10-10 cs.LG cs.AI cs.CL 67%

Understanding In-context Learning of Addition via Activation Subspaces

Xinyan Hu, Kayo Yin, Michael I. Jordan, Jacob Steinhardt, Lijie Chen

机构 * UC Berkeley(伯克利大学) INRIA(法国国家信息与自动化研究所)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07645 2025-10-10 cs.CL cs.AI 62%

Banking Done Right: Redefining Retail Banking with Language-Centric AI

Xin Jie Chua, Jeraelyn Ming Li Tan, Jia Xuan Tan, Soon Chang Poh, Yi Xian Goh, Debbie Hui Tian Choong, Chee Mun Foong, Sze Jue Yang, Chee Seng Chan

机构 * Universiti Malaya(马来大学) YTL AI Labs(YTL人工智能实验室) Ryt Bank(Ryt银行)

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at EMNLP2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00139 2025-10-10 cs.CV 50%

EFSA: Episodic Few-Shot Adaptation for Text-to-Image Retrieval

Muhammad Huzaifa, Yova Kementchedjhieva

机构 * MBZUAI(马尔堡人工智能研究所)

专题命中 指令微调 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏