arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-22 至 2025-10-22 共收录 21 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 21 篇

2510.17895 2025-10-22 cs.LG cs.AI cs.CL 90%

Hierarchical Federated Unlearning for Large Language Models

Yisheng Zhong, Zhengbang Yang, Zhuangdi Zhu

机构 * George Mason University(乔治·玛莎大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18143 2025-10-22 cs.AI cs.LG 90%

Learning from Generalization Patterns: An Evaluation-Driven Approach to Enhanced Data Augmentation for Fine-Tuning Small Language Models

Huan Song, Deeksha Razdan, Yiyue Qian, Arijit Ghosh Chowdhury, Parth Patwa, Aman Chadha, Shinan Zhang, Sharlina Keshava, Hannah Marlowe

机构 * AWS Generative AI Innovation Center(AWS生成式AI创新中心)

专题命中 指令微调 :language model(title,abstract);small language model(title,abstract);LLM(abstract,comments);分类 cs.AI、cs.LG

Comments Neural Information Processing Systems (NeurIPS 2025) Workshop: Evaluating the Evolving LLM Lifecycle

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17844 2025-10-22 cs.CL cs.AI cs.MA 90%

Modeling Layered Consciousness with Multi-Agent Large Language Models

Sang Hun Kim, Jongmin Lee, Dongkyu Park, So Young Lee, Yosep Chong

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);分类 cs.CL、cs.AI

Comments 20 pages, 4 figures, accepted for presentation at EMNLP 2025 Workshop on Active and Passive LLM Personalization (PALS) OpenReview: https://openreview.net/forum?id=rUtNkYvGJI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18288 2025-10-22 cs.CL 90%

BrailleLLM: Braille Instruction Tuning with Large Language Models for Braille Domain Tasks

Tianyuan Huang, Zepeng Zhu, Hangdi Xing, Zirui Shao, Zhi Yu, Chaoxiong Yang, Jiaxian He, Xiaozhong Liu, Jiajun Bu

机构 * Zhejiang Key Laboratory of Accessible Perception and Intelligent Systems, Zhejiang University(浙江无障碍感知与智能系统重点实验室,浙江大学) Alibaba Group(阿里巴巴集团) Worcester Polytechnic Institute(沃斯特理工学院) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and DataSecurity(杭州高新技术区(滨江)区块链与数据安全研究院)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(title);language model(title);分类 cs.CL

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17919 2025-10-22 cs.CR cs.AI 89%

ParaVul: A Parallel Large Language Model and Retrieval-Augmented Framework for Smart Contract Vulnerability Detection

Tenghui Huang, Jinbo Wen, Jiawen Kang, Siyong Chen, Zhengtao Li, Tao Zhang, Dongning Liu, Jiacheng Wang, Chengjun Cai, Yinqiu Liu, Dusit Niyato

机构 * School of Automation, Guangdong University of Technology(广东科技大學自動化學院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大學計算機科學與技術學院) School of Cyberspace Science and Technology, Beijing Jiaotong University(北京交通大學網絡空間科學與技術學院) School of Computer Science and Technology, Guangdong University of Technology(廣東科技大學計算機科學與技術學院) College of Computing and Data Science, Nanyang Technological University(南洋理工大學計算與數據科學學院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21657 2025-10-22 cs.CL cs.AI cs.LG 89%

Explaining Large Language Models with gSMILE

Zeinab Dehghani, Mohammed Naveed Akram, Koorosh Aslansefat, Adil Khan, Yiannis Papadopoulos

机构 * University of Hull(赫尔大学) Fraunhofer IESE(弗劳恩霍夫研究所)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01328 2025-10-22 cs.CL 88%

Can Large Language Models Master Complex Card Games?

Wei Wang, Fuqing Bie, Junzhe Chen, Dan Zhang, Shiyu Huang, Evgeny Kharlamov, Jie Tang

机构 * Nankai University(南开大学) Tsinghua University(清华大学) Beijing University of Posts and Telecommunications(北京邮电大学) Zhipu AI(智谱AI) Bosch Center for Artificial Intelligence(博世人工智能中心)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18250 2025-10-22 cs.AI 85%

ssToken: Self-modulated and Semantic-aware Token Selection for LLM Fine-tuning

Xiaohan Qin, Xiaoxing Wang, Ning Liao, Cancheng Zhang, Xiangdong Zhang, Mingquan Feng, Jingzhi Wang, Junchi Yan

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18228 2025-10-22 cs.LG 85%

Towards Fast LLM Fine-tuning through Zeroth-Order Optimization with Projected Gradient-Aligned Perturbations

Zhendong Mi, Qitao Tan, Grace Li Zhang, Zhaozhuo Xu, Geng Yuan, Shaoyi Huang

机构 * Stevens Institute of Technology(史蒂文斯理工学院) University of Georgia(佐治亚大学) Technical University of Darmstadt(达姆施塔特技术大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17847 2025-10-22 cs.CV 85%

CoIDO: Efficient Data Selection for Visual Instruction Tuning via Coupled Importance-Diversity Optimization

Yichen Yan, Ming Zhong, Qi Zhu, Xiaoling Gu, Jinpeng Chen, Huan Li

机构 * The State Key Laboratory of Blockchain and Data Security(区块链与数据安全国家重点实验室) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) Hangzhou Dianzi University(杭州电子科技大学) School of Computer Science (National Pilot Software Engineering School), BUPT(计算机学院(国家级试点软件工程学院),北京邮电大学)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract)

Comments 22 pages, 8 figures, 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18081 2025-10-22 cs.LG cs.AI 79%

Any-Depth Alignment: Unlocking Innate Safety Alignment of LLMs to Any-Depth

Jiawei Zhang, Andrew Estornell, David D. Baek, Bo Li, Xiaojun Xu

机构 * University of Chicago(芝加哥大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18773 2025-10-22 cs.CV 78%

Detection and Simulation of Urban Heat Islands Using a Fine-Tuned Geospatial Foundation Model for Microclimate Impact Prediction

Jannis Fleckenstein, David Kreismann, Tamara Rosemary Govindasamy, Thomas Brunschwiler, Etienne Vos, Mattia Rigotti

机构 * IBM Research – Europe(IBM欧洲研究院) IBM Research – Africa(IBM非洲研究院)

专题命中 指令微调 :foundation model(title,abstract)

Comments 10 pages, 9 figures. Accepted at the NeurIPS 2025 Workshop on Tackling Climate Change with Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10784 2025-10-22 eess.IV cs.CV 78%

Adapting Medical Vision Foundation Models for Volumetric Medical Image Segmentation via Active Learning and Selective Semi-supervised Fine-tuning

Jin Yang, Daniel S. Marcus, Aristeidis Sotiras

机构 * Mallinckrodt Institute of Radiology(马林克罗德放射医学研究所) Institute for Informatics, Data Science and Biostatistics(信息学、数据科学与生物统计学研究所) Department of Radiology, Perelman School of Medicine(放射科,佩尔曼医学院) Center for AI and Data Science for Integrated Diagnostics (AI2D)(集成诊断人工智能与数据科学中心(AI2D))

专题命中 指令微调 :foundation model(title,abstract)

Comments 17 pages, 5 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06239 2025-10-22 cs.AI 77%

Proof2Silicon: Prompt Repair for Verified Code and Hardware Generation via Reinforcement Learning

Manvi Jha, Jiaxin Wan, Deming Chen

机构 * Electrical and Computer Engineering(电气与计算机工程系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18484 2025-10-22 cs.CR 75%

The Attribution Story of WhisperGate: An Academic Perspective

Oleksandr Adamov, Anders Carlsson

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Virus Bulletin Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18257 2025-10-22 cs.CL cs.AI 73%

DelvePO: Direction-Guided Self-Evolving Framework for Flexible Prompt Optimization

Tao Tao, Guanghui Zhu, Lang Guo, Hongyi Chen, Chunfeng Yuan, Yihua Huang

机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01480 2025-10-22 cs.CV 67%

Janus-Pro-R1: Advancing Collaborative Visual Comprehension and Generation via Reinforcement Learning

Kaihang Pan, Yang Wu, Wendong Bu, Kai Shen, Juncheng Li, Yingting Wang, Yunfei Li, Siliang Tang, Jun Xiao, Fei Wu, Hang Zhao, Yueting Zhuang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18723 2025-10-22 cs.CL cs.LG cs.SD eess.AS 62%

Bayesian Low-Rank Factorization for Robust Model Adaptation

Enes Yavuz Ugan, Ngoc-Quan Pham, Alexander Waibel

机构 * Interactive Systems Lab, Karlsruhe Institut of Technology (KIT), Germany(交互系统实验室,卡尔斯鲁厄理工学院(KIT),德国) InterACT, Carnegie Mellon University (CMU), USA(InterACT,卡内基梅隆大学(CMU),美国)

专题命中 指令微调 :foundation model(abstract);分类 cs.CL、cs.LG

Comments Submitted to ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18053 2025-10-22 cs.LG cs.AI 62%

Adaptive Divergence Regularized Policy Optimization for Fine-tuning Generative Models

Jiajun Fan, Tong Wei, Chaoran Cheng, Yuxin Chen, Ge Liu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 指令微调 :LLM(abstract);分类 cs.AI、cs.LG

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23868 2025-10-22 cs.LG cs.AI 62%

Noise-Robustness Through Noise: A Framework combining Asymmetric LoRA with Poisoning MoE

Zhaokun Wang, Jinyu Guo, Jingwen Pu, Lingfeng Chen, Hongli Pu, Jie Ou, Libo Qin, Wenhong Tian

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(信息与软件工程学院,电子科学与技术大学) School of Computer Science and Engineering, Central South University(计算机科学与工程学院,中南大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments Accecpted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18837 2025-10-22 cs.CV 50%

FedDEAP: Adaptive Dual-Prompt Tuning for Multi-Domain Federated Learning

Yubin Zheng, Pak-Hei Yeung, Jing Xia, Tianjie Ju, Peng Tang, Weidong Qiu, Jagath C. Rajapakse

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

专题命中 指令微调 :language model(abstract)

Comments Accepted at MM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏