arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-15 至 2025-08-15 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 23 篇

2503.23714 2025-08-15 cs.CL 91%

Building Instruction-Tuning Datasets from Human-Written Instructions with Open-Weight Large Language Models

Youmi Ma, Sakae Mizuki, Kazuki Fujii, Taishi Nakamura, Masanari Ohi, Hinari Shimada, Taihei Shiotani, Koshiro Saito, Koki Maeda, Kakeru Hattori, Takumi Okamoto, Shigeki Ishida, Rio Yokota, Hiroya Takamura, Naoaki Okazaki

机构 * Department of Computer Science, School of Computing, Institute of Science Tokyo(计算机科学系、计算学院、科学东京研究所) National Institute of Advanced Industrial Science and Technology(国家先进工业科学与技术研究院) Research and Development Center for Large Language Models, NII(大型语言模型研究与开发中心、日本科学振兴会)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract,comments);instruction tuning(abstract)

Comments COLM 2025; Datasets are available at https://huggingface.co/datasets/tokyotech-llm/lmsys-chat-1m-synth

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04385 2025-08-15 cs.CL cs.AI 90%

MELABenchv1: Benchmarking Large Language Models against Smaller Fine-Tuned Models for Low-Resource Maltese NLP

Kurt Micallef, Claudia Borg

机构 * Department of Artificial Intelligence, University of Malta(人工智能系,马耳他大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments mT5 XXL & EuroLLM Instruct 9B 1-shot results

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10467 2025-08-15 cs.AI cs.DL 85%

FIRESPARQL: A LLM-based Framework for SPARQL Query Generation over Scholarly Knowledge Graphs

Xueli Pan, Victor de Boer, Jacco van Ossenbruggen

机构 * Vrije Universiteit Amsterdam(阿姆斯特丹自由大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at 17th International Joint Conference on Knowledge Discovery, Knowledge Engineering and Knowledge Management (IC3K)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10645 2025-08-15 cs.CV 85%

SemPT: Semantic Prompt Tuning for Vision-Language Models

Xiao Shi, Yangjun Ou, Zhenzhong Chen

机构 * School of Computer Science and Artificial Intelligence, Wuhan Textile University(武汉纺织大学计算机科学与人工智能学院) School of Remote Sensing and Information Engineering, Wuhan University(武汉大学遥感与信息工程学院)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09549 2025-08-15 cs.SI 85%

CS-Agent: LLM-based Community Search via Dual-agent Collaboration

Jiahao Hua, Long Yuan, Qingshuai Feng, Qiang Fan, Shan Huang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10116 2025-08-15 cs.IR 83%

Bridging Modality Gaps in e-Commerce Products via Vision-Language Alignment

Yipeng Zhang, Hongju Yu, Aritra Mandal, Canran Xu, Qunzhi Zhou, Zhe Wu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10349 2025-08-15 cs.DC cs.LG 79%

Flexible Personalized Split Federated Learning for On-Device Fine-Tuning of Foundation Models

Tianjun Yuan, Jiaxiang Geng, Pengchao Han, Xianhao Chen, Bing Luo

机构 * Duke Kunshan University(杜克大学昆山学院) The University of Hong Kong(香港大学) Guangdong University of Technology(广东技术大学)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

Comments 10 pages, Submitted to INFOCOM2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10008 2025-08-15 cs.CL cs.LG 79%

Multidimensional classification of posts for online course discussion forum curation

Antonio Leandro Martins Candido, Jose Everardo Bessa Maia

机构 * Federal Institute of Education, Science, and Technology of Ceará (IFCE)(巴西塞阿市联邦教育、科学和技术 institute) State University of Ceará – CCT-PPGCC-UECE(塞阿州大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 8 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18475 2025-08-15 cs.LG cs.AI 79%

CLoQ: Enhancing Fine-Tuning of Quantized LLMs via Calibrated LoRA Initialization

Yanxia Deng, Aozhong Zhang, Selcuk Gurses, Naigang Wang, Zi Yang, Penghang Yin

机构 * Department of Mathematics and Statistics(数学与统计学系) University at Albany, SUNY(阿尔巴尼大学) IBM T. J. Watson Research Center(IBM 塔沃森研究中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref Transactions on Machine Learning Research (TMLR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10355 2025-08-15 cs.CL 77%

Making Qwen3 Think in Korean with Reinforcement Learning

Jungyup Lee, Jemin Kim, Sang Park, SeungJae Lee

机构 * Jungyup Lee, Jemin Kim, Sang Park, SeungJae Lee(作者)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19530 2025-08-15 cs.LG cs.AI 76%

VectorFit : Adaptive Singular & Bias Vector Fine-Tuning of Pre-trained Foundation Models

Suhas G Hegde, Shilpy Kaur, Aruna Tiwari

机构 * Indian Institute of Technology Indore(印度理工学院印多尔)

专题命中 指令微调 :foundation model(title);分类 cs.AI、cs.LG

Comments This paper has been accepted in the 28th European Conference on Artificial Intelligence (ECAI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04801 2025-08-15 cs.CV 75%

OrderChain: Towards General Instruct-Tuning for Stimulating the Ordinal Understanding Ability of MLLM

Jinhong Wang, Shuo Tong, Jian liu, Dongqi Tang, Weiqiang Wang, Wentong Li, Hongxia Xu, Danny Chen, Jintai Chen, Jian Wu

机构 * College of Computer Science & Technology, Zhejiang University(浙江大学计算机科学与技术学院) Transvascular Implantation Devices Research Institute and Liangzhu Laboratory(血管植入物研究机构和良渚实验室) Ant Group(蚂蚁集团) University of Notre Dame(圣母大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06293 2025-08-15 cs.CV 75%

Mastering Collaborative Multi-modal Data Selection: A Focus on Informativeness, Uniqueness, and Representativeness

Qifan Yu, Zhebei Shen, Zhongqi Yue, Yang Wu, Bosheng Qin, Wenqiao Zhang, Yunfei Li, Juncheng Li, Siliang Tang, Yueting Zhuang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Ant Group(蚂蚁集团)

专题命中 指令微调 :large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments ICCV 2025 Highlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16770 2025-08-15 cs.CL cs.AI 73%

LED-Merging: Mitigating Safety-Utility Conflicts in Model Merging with Location-Election-Disjoint

Qianli Ma, Dongrui Liu, Qian Chen, Linfeng Zhang, Jing Shao

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) East China Normal University(华东师范大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10369 2025-08-15 cs.CL 70%

Improving Generative Cross-lingual Aspect-Based Sentiment Analysis with Constrained Decoding

Jakub Šmíd, Pavel Přibáň, Pavel Král

机构 * Department of Computer Science and Engineering, University of West Bohemia in Pilsen(西波希米亚大学皮尔森分校计算机科学与工程系) NTIS - New Technologies for the Information Society, University of West Bohemia in Pilsen(信息社会新技术机构,西波希米亚大学皮尔森分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10371 2025-08-15 cs.RO 67%

Few-shot Vision-based Human Activity Recognition with MLLM-based Visual Reinforcement Learning

Wenqi Zheng, Yutaka Arakawa

机构 * Graduate School(研究生院) Faculty of Information Science(信息科学系) Electrical Engineering(电气工程) Kyushu University(九州大学) JAPAN(日本)

专题命中 指令微调 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10075 2025-08-15 astro-ph.IM 67%

Teaching LLMs to Speak Spectroscopy

Nesar Ramachandra, Yuan-Sen Ting, Zechang Sun, Azton Wells, Salman Habib

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments 6 pages, 1 figure, Accepted to the Machine Learning for Astrophysics (ML4Astro) Colocated Workshop at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10416 2025-08-15 cs.RO cs.AI cs.CL cs.CV 62%

CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model

Zhuoyuan Yu, Yuxing Long, Zihan Yang, Chengyan Zeng, Hongwei Fan, Jiyao Zhang, Hao Dong

专题命中 指令微调 :post-training(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13307 2025-08-15 cs.CV cs.AI 57%

Quantitative Comparison of Fine-Tuning Techniques for Pretrained Latent Diffusion Models in the Generation of Unseen SAR Images

Solène Debuysère, Nicolas Trouvé, Nathan Letheule, Olivier Lévêque, Elise Colin

机构 * Paris-Saclay University(巴黎-萨克雷大学) ONERA - The French Aerospace Lab(法国航空航天实验室)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10299 2025-08-15 cs.LG cs.CV 57%

Improving Learning of New Diseases through Knowledge-Enhanced Initialization for Federated Adapter Tuning

Danni Peng, Yuan Wang, Kangning Cai, Peiyan Ning, Jiming Xu, Yong Liu, Rick Siow Mong Goh, Qingsong Wei, Huazhu Fu

机构 * Institute of High Performance Computing (IHPC), Agency for Science, Technology and Research (A*STAR)(高性能计算研究所(IHPC),科技研究局(A*STAR)) EVYD Technology(EVYD技术)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10104 2025-08-15 cs.CV cs.LG 57%

DINOv3

Oriane Siméoni, Huy V. Vo, Maximilian Seitzer, Federico Baldassarre, Maxime Oquab, Cijo Jose, Vasil Khalidov, Marc Szafraniec, Seungeun Yi, Michaël Ramamonjisoa, Francisco Massa, Daniel Haziza, Luca Wehrstedt, Jianyuan Wang, Timothée Darcet, Théo Moutakanni, Leonel Sentana, Claire Roberts, Andrea Vedaldi, Jamie Tolan, John Brandt, Camille Couprie, Julien Mairal, Hervé Jégou, Patrick Labatut, Piotr Bojanowski

机构 * Meta AI Research(Meta AI研究院) WRI(世界知识产权组织) Inria(法国国家信息与自动化研究所)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10456 2025-08-15 eess.AS 50%

Exploring Cross-Utterance Speech Contexts for Conformer-Transducer Speech Recognition Systems

Mingyu Cui, Mengzhe Geng, Jiajun Deng, Chengxi Deng, Jiawen Kang, Shujie Hu, Guinan Li, Tianzi Wang, Zhaoqing Li, Xie Chen, Xunying Liu

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01272 2025-08-15 cs.CV 50%

PromptSafe: Gated Prompt Tuning for Safe Text-to-Image Generation

Zonglei Jing, Xiao Yang, Xiaoqian Li, Siyuan Liang, Aishan Liu, Mingchuan Zhang, Xianglong Liu

机构 * Beihang University(北航) Beijing University of Posts and Telecommunications(北京邮电大学) Taishan University(泰山大学) Nanyang Technological University(南洋理工大学) Henan University of Science and Technology(河南科技大学)

专题命中 指令微调 :LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏