arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-10 至 2025-09-10 共收录 15 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 15 篇

2310.16582 2025-09-10 cs.CL 89%

UPLex: Fine-Grained Personality Control in Large Language Models via Unsupervised Lexical Modulation

Tianlong Li, Wenhao Liu, Muling Wu, Shihan Dou, Zhenghua Wang, Changze Lv, Xiaohua Wang, Xiaoqing Zheng, Xuanjing Huang

机构 * School of Computer Science, Fudan University(复旦大学计算机学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20454 2025-09-10 cs.LG cs.CL 88%

CoMMIT: Coordinated Multimodal Instruction Tuning

Xintong Li, Junda Wu, Tong Yu, Yu Wang, Xiang Chen, Jiuxiang Gu, Lina Yao, Julian McAuley, Jingbo Shang

机构 * University of California, San Diego(加州大学圣地亚哥分校) Adobe Research(Adobe研究) The University of New South Wales(新南威尔士大学) CSIRO’s Data61(澳大利亚联邦科学与工业研究组织的数据61)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04795 2025-09-10 cs.CL cs.AI cs.SD eess.AS 86%

Enhancing Dialogue Annotation with Speaker Characteristics Leveraging a Frozen LLM

Thomas Thebaud, Yen-Ju Lu, Matthew Wiesner, Peter Viechnicki, Najim Dehak

机构 * Electrical and Computer Engineering Department, Johns Hopkins University, Baltimore, MD, USA(约翰霍普金斯大学电气与计算机工程系) Human Language Technology Center of Excellence, Johns Hopkins University, Baltimore, MD, USA(约翰霍普金斯大学人机语言技术卓越中心)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

Comments Accepted in the 2025 IEEE Automatic Speech Recognition and Understanding Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07488 2025-09-10 cs.CV cs.AI 79%

Fine-Tuning Vision-Language Models for Visual Navigation Assistance

Xiao Li, Bharat Gandhi, Ming Zhan, Mohit Nehra, Zhicheng Zhang, Yuchen Sun, Meijia Song, Naisheng Zhang, Xi Wang

机构 * University of Florida, Gainesville, FL, USA(佛罗里达大学) University of Minnesota, Minneapolis, MN, USA(明尼苏达大学) New York University, New York, NY, USA(纽约大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23903 2025-09-10 cs.CV cs.AI 79%

Grounding DINO-US-SAM: Text-Prompted Multi-Organ Segmentation in Ultrasound with LoRA-Tuned Vision-Language Models

Hamza Rasaee, Taha Koleilat, Hassan Rivaz

机构 * Department of Electrical and Computer Engineering, Concordia University(电气与计算机工程系,康科迪亚大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

Comments 11 pages, 3 figures, 7 tables

Journal ref IEEE Transactions on Ultrasonics, Ferroelectrics, and Frequency Control, Sept. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06992 2025-09-10 cs.CV 78%

FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models

Kun Zhai, Siheng Chen, Xingjun Ma, Yu-Gang Jiang

机构 * Fudan University, Shanghai, China(复旦大学) Shanghai Jiao Tong University, Shanghai, China(上海交通大学)

专题命中 指令微调 :language model(title,abstract)

Comments ACM MM25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17450 2025-09-10 cs.CL cs.CY 77%

Persuasion Dynamics in LLMs: Investigating Robustness and Adaptability in Knowledge and Safety with DuET-PD

Bryan Chen Zhengyu Tan, Daniel Wai Kit Chin, Zhengyuan Liu, Nancy F. Chen, Roy Ka-Wei Lee

机构 * Singapore University of Technology and Design (SUTD)(新加坡科技设计大学) Institute for Infocomm Research (I2R), A*STAR, Singapore(信息通信研究院)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments To appear at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07768 2025-09-10 cs.CL cs.AI 73%

Are LLMs Enough for Hyperpartisan, Fake, Polarized and Harmful Content Detection? Evaluating In-Context Learning vs. Fine-Tuning

Michele Joshua Maggini, Dhia Merzougui, Rabiraj Bandyopadhyay, Gaël Dias, Fabrice Maurel, Pablo Gamallo

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12791 2025-09-10 cs.CL cs.AI 73%

CTourLLM: Enhancing LLMs with Chinese Tourism Knowledge

Qikai Wei, Mingzhi Yang, Jinqiang Wang, Wenwei Mao, Jiabo Xu, Huansheng Ning

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07824 2025-09-10 cs.AI 70%

Addition in Four Movements: Mapping Layer-wise Information Trajectories in LLMs

Yao Yan

机构 * Chongqing Normal University(重庆师范大学) College of Computer and Information Science(计算机与信息科学学院) Chongqing Key Lab of Cognitive Intelligence and Intelligent Finance(重庆认知智能与智能金融重点实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 12 pages, including appendix, 7 figures. EMNLP 2025 submission (ARR May 2025 cycle, reviews pending)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04378 2025-09-10 cs.CV 67%

Aesthetic Image Captioning with Saliency Enhanced MLLMs

Yilin Tao, Jiashui Huang, Huaze Xu, Ling Shao

专题命中 指令微调 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11505 2025-09-10 cs.CV 67%

MSCPT: Few-shot Whole Slide Image Classification with Multi-scale and Context-focused Prompt Tuning

Minghao Han, Linhao Qu, Dingkang Yang, Xukun Zhang, Xiaoying Wang, Lihua Zhang

机构 * Academy for Engineering and Technology, Fudan University(工程与技术学院,复旦大学) Fudan University(复旦大学) Zhongshan Hospital, Fudan University(复旦大学中山医院)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments This work has been submitted to the IEEE TMI for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05209 2025-09-10 cs.CL 57%

Hunyuan-MT Technical Report

Mao Zheng, Zheng Li, Bingxin Qu, Mingyang Song, Yang Du, Mingrui Sun, Di Wang

机构 * Tencent Hunyuan Team(腾讯文心团队)

专题命中 指令微调 :SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10548 2025-09-10 cs.LG q-bio.BM 57%

BioNeMo Framework: a modular, high-performance library for AI model development in drug discovery

Peter St. John, Dejun Lin, Polina Binder, Malcolm Greaves, Vega Shah, John St. John, Adrian Lange, Patrick Hsu, Rajesh Illango, Arvind Ramanathan, Anima Anandkumar, David H Brookes, Akosua Busia, Abhishaike Mahajan, Stephen Malina, Neha Prasad, Sam Sinai, Lindsay Edwards, Thomas Gaudelet, Cristian Regep, Martin Steinegger, Burkhard Rost, Alexander Brace, Kyle Hippe, Luca Naef, Keisuke Kamata, George Armstrong, Kevin Boyd, Zhonglin Cao, Han-Yi Chou, Simon Chu, Allan dos Santos Costa, Sajad Darabi, Eric Dawson, Kieran Didi, Cong Fu, Mario Geiger, Michelle Gill, Darren J Hsu, Gagan Kaushik, Maria Korshunova, Steven Kothen-Hill, Youhan Lee, Meng Liu, Micha Livne, Zachary McClure, Jonathan Mitchell, Alireza Moradzadeh, Ohad Mosafi, Youssef Nashed, Saee Paliwal, Yuxing Peng, Sara Rabhi, Farhad Ramezanghorbani, Danny Reidenbach, Camir Ricketts, Brian C Roland, Kushal Shah, Tyler Shimko, Hassan Sirelkhatim, Savitha Srinivasan, Abraham C Stern, Dorota Toczydlowska, Srimukh Prasad Veccham, Niccolò Alberto Elia Venanzi, Anton Vorontsov, Jared Wilber, Isabel Wilkinson, Wei Jing Wong, Eva Xue, Cory Ye, Xin Yu, Yang Zhang, Guoqing Zhou, Becca Zandstein, Alejandro Chacon, Prashant Sohani, Maximilian Stadler, Christian Hundt, Feiwen Zhu, Christian Dallago, Bruno Trentini, Emine Kucukbenli, Saee Paliwal, Timur Rvachov, Eddie Calleja, Johnny Israeli, Harry Clifford, Risto Haukioja, Nicholas Haemel, Kyle Tretina, Neha Tadimeti, Anthony B Costa

专题命中 指令微调 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09788 2025-09-10 cs.SD eess.AS 50%

HingeNet: A Harmonic-Aware Fine-Tuning Approach for Beat Tracking

Ganghui Ru, Jieying Wang, Jiahao Zhao, Yulun Wu, Yi Yu, Nannan Jiang, Wei Wang, Wei Li

机构 * School of Computer Science, Fudan University, Shanghai, China(复旦大学计算机科学学院) Naval Medical Center, PLA, China(中国人民解放军海军医疗中心) Graduate School of Informatics, Kyoto University, Kyoto, Japan(京都大学信息科学研究生院) Graduate School of Advanced Science and Engineering, Hiroshima University, Hiroshima, Japan(广岛大学先进科学与工程研究生院) Shanghai Key Laboratory of Intelligent Information Processing, Fudan University, Shanghai, China(上海智能信息处理重点实验室)

专题命中 指令微调 :foundation model(abstract)

Comments Early draft for discussion only. Undergoing active revision, conclusions subject to change. Do not cite. Formal peer-reviewed version in preparation

详情

展开后加载摘要…

URL PDF HTML 收藏