arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-19 至 2025-08-19 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 23 篇

2406.08391 2025-08-19 cs.LG cs.AI cs.CL stat.ML 91%

Large Language Models Must Be Taught to Know What They Don't Know

Sanyam Kapoor, Nate Gruver, Manley Roberts, Katherine Collins, Arka Pal, Umang Bhatt, Adrian Weller, Samuel Dooley, Micah Goldblum, Andrew Gordon Wilson

机构 * New York University(纽约大学) Abacus AI Cambridge University(剑桥大学) Columbia University(哥伦比亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

Comments NeurIPS 2024 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11953 2025-08-19 cs.AI 89%

Data Mixing Optimization for Supervised Fine-Tuning of Large Language Models

Yuan Li, Zhengzhong Liu, Eric Xing

机构 * Carnegie Mellon University(卡内基梅隆大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12622 2025-08-19 cs.CR 89%

Consiglieres in the Shadow: Understanding the Use of Uncensored Large Language Models in Cybercrimes

Zilong Lin, Zichuan Li, Xiaojing Liao, XiaoFeng Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11280 2025-08-19 cs.CL 88%

High-Dimensional Interlingual Representations of Large Language Models

Bryan Wilie, Samuel Cahyawijaya, Junxian He, Pascale Fung

机构 * Hong Kong University of Science and Technology(香港理工大学) Cohere

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12458 2025-08-19 cs.CL 87%

M3PO: Multimodal-Model-Guided Preference Optimization for Visual Instruction Following

Ruirui Gao, Emily Johnson, Bowen Tan, Yanfei Qian

机构 * University of Massachusetts, Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 指令微调 :preference optimization(title,abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12031 2025-08-19 cs.CL 85%

Learning Wisdom from Errors: Promoting LLM's Continual Relation Learning through Exploiting Error Cases

Shaozhe Yin, Jinyu Guo, Kai Shuang, Xia Liu, Ruize Ou

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) University of Electronic Science and Technology of China(电子科技大学) China National Institute of Standardization(中国标准化研究院)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11889 2025-08-19 cs.CL 85%

In-Context Examples Matter: Improving Emotion Recognition in Conversation with Instruction Tuning

Hui Ma, Bo Zhang, Jinpeng Hu, Zenglin Shi

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12512 2025-08-19 cs.CV 85%

LangVision-LoRA-NAS: Neural Architecture Search for Variable LoRA Rank in Vision Language Models

Krishna Teja Chitty-Venkata, Murali Emani, Venkatram Vishwanath

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract)

Comments Accepted by ICIP 2025 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.15714 2025-08-19 cs.CL 84%

Chinchunmei at SemEval-2025 Task 11: Boosting the Large Language Model's Capability of Emotion Perception using Contrastive Learning

Tian Li, Yujian Sun, Huizhi Liang

机构 * School of Computing, Newcastle University(计算学院,新卡斯尔大学) Shumei AI Research Institute(舒美人工智能研究院)

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Journal ref Association for Computational Linguistics, Proceedings of the 19th International Workshop on Semantic Evaluation (SemEval-2025), 319-330

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12662 2025-08-19 cs.CL cs.AI 81%

Breaking Language Barriers: Equitable Performance in Multilingual Language Models

Tanay Nagar, Grigorii Khvatskii, Anna Sokol, Nitesh V. Chawla

机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) NSF Center for Computer Assisted Synthesis (CCAS), University of Notre Dame(国家科学基金会计算机辅助合成中心(CCAS)、诺特大学) University of Notre Dame(诺特大学)

专题命中 指令微调 :language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted as a non-archival work-in-progress paper at the NAACL 2025 Student Research Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12531 2025-08-19 cs.LG cs.AI 81%

Rethinking Safety in LLM Fine-tuning: An Optimization Perspective

Minseon Kim, Jin Myung Kwak, Lama Alssum, Bernard Ghanem, Philip Torr, David Krueger, Fazl Barez, Adel Bibi

机构 * Microsoft Research(微软研究院) KAIST(韩国科学技术院) KAUST(韩国科学技术大学) Université de Montréal(蒙特利尔大学) Mila(蒙特利尔人工智能研究院) WhiteBox(WhiteBox公司) University of Oxford(牛津大学)

专题命中 指令微调 :LLM(title);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12137 2025-08-19 cs.CV 79%

Infusing fine-grained visual knowledge to Vision-Language Models

Nikolaos-Antonios Ypsilantis, Kaifeng Chen, André Araujo, Ondřej Chum

机构 * VRG, FEE, Czech Technical University in Prague(捷克布拉格技术大学)

专题命中 指令微调 :language model(title,abstract);foundation model(comments)

Comments ICCVW 2025 accepted paper. Workshop name: "What is Next in Multimodal Foundation Models?"

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12877 2025-08-19 cs.CV 78%

Preserve and Sculpt: Manifold-Aligned Fine-tuning of Vision-Language Models for Few-Shot Learning

Dexia Chen, Qianjie Zhu, Weibing Li, Yue Yu, Tong Zhang, Ruixuan Wang

专题命中 指令微调 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12935 2025-08-19 cs.AI 77%

Towards Open-Ended Emotional Support Conversations in LLMs via Reinforcement Learning with Future-Oriented Rewards

Ting Yang, Li Chen, Huimin Wang

机构 * Hong Kong Baptist University(香港 Baptist 大学) Jarvis Lab(Jarvis 实验室)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07745 2025-08-19 cs.CL 77%

StepTool: Enhancing Multi-Step Tool Usage in LLMs via Step-Grained Reinforcement Learning

Yuanqing Yu, Zhefan Wang, Weizhi Ma, Shuai Wang, Chuhan Wu, Zhiqiang Guo, Min Zhang

机构 * DCST, Tsinghua University(清华大学数据科学研究院) Quan Cheng Laboratory(钱塘实验室) AIR, Tsinghua University(清华大学人工智能研究院) Huawei Noah's Ark Lab(华为诺亚实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.CL

Comments Accepted by CIKM'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.11319 2025-08-19 cs.CV cs.AI 77%

GeoSAM: Fine-tuning SAM with Multi-Modal Prompts for Mobility Infrastructure Segmentation

Rafi Ibn Sultan, Chengyin Li, Hui Zhu, Prashant Khanduri, Marco Brocanelli, Dongxiao Zhu

机构 * Department of Computer Science, Wayne State University, Detroit, MI, USA 48202(计算机科学系,韦恩州立大学) Department of Radiation Oncology, Henry Ford Health, Detroit, MI, USA 48202(放射肿瘤科,亨利福特健康) Department of Electrical and Computer Engineering, The Ohio State University, Columbus, Ohio, USA 43210(电气与计算机工程系,俄亥俄州立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI

Comments Accepted by European Conference on Artificial Intelligence (ECAI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11985 2025-08-19 cs.LG cs.AI 73%

Efficient Modular Learning through Naive LoRA Summation: Leveraging Orthogonality in High-Dimensional Models

Zhanhao Cao, Clement Truong, Andrew Lizarraga

机构 * University of California, Los Angeles (UCLA)(加州大学洛杉矶分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11831 2025-08-19 cs.CL cs.AI 73%

When Does Language Transfer Help? Sequential Fine-Tuning for Cross-Lingual Euphemism Detection

Julia Sammartino, Libby Barak, Jing Peng, Anna Feldman

机构 * Montclair State University(蒙特克莱尔州立大学)

专题命中 指令微调 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments RANLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05346 2025-08-19 cs.CL cs.AI cs.LG 67%

LoRA-Augmented Generation (LAG) for Knowledge-Intensive Language Tasks

William Fleshman, Benjamin Van Durme

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12155 2025-08-19 cs.LG cs.AI 62%

SGPT: Few-Shot Prompt Tuning for Signed Graphs

Zian Zhai, Sima Qing, Xiaoyang Wang, Wenjie Zhang

机构 * The University of New South Wales(新南威尔士大学)

专题命中 指令微调 :prompting(abstract);分类 cs.AI、cs.LG

Comments CIKM'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11710 2025-08-19 cs.CR cs.AI cs.CL 62%

Code Vulnerability Detection Across Different Programming Languages with AI Models

Hael Abdulhakim Ali Humran, Ferdi Sonmez

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11673 2025-08-19 cs.LG cs.AI cs.CV cs.MM 62%

Contrastive Regularization over LoRA for Multimodal Biomedical Image Incremental Learning

Haojie Zhang, Yixiong Liang, Hulin Kuang, Lihui Cen, Zhe Qu, Yigang Cen, Min Zeng, Shichao Kan

机构 * School of Computer Science and Engineering, Central South University(计算机科学与工程学院,中南大学) School of Automation, Central South University(自动化学院,中南大学) School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学)

专题命中 指令微调 :language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages, 3 figures, submitted to ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07402 2025-08-19 cs.CV 50%

ForensicsSAM: Toward Robust and Unified Image Forgery Detection and Localization Resisting to Adversarial Attack

Rongxuan Peng, Shunquan Tan, Chenqi Kong, Anwei Luo, Alex C. Kot, Jiwu Huang

机构 * Shenzhen Key Laboratory of Media Security, Faculty of Electronic and Information Engineering, Shenzhen University, China(深圳媒体安全重点实验室,电子与信息工程学院,深圳大学,中国) Rapid-Rich Object Search (ROSE) Lab, School of Electrical and Electronic Engineering, Nanyang Technological University, Singapore(快速富对象搜索(ROSE)实验室,电气电子工程学院,南洋理工大学,新加坡) Guangdong Laboratory of Machine Perception and Intelligent Computing, Faculty of Engineering, Shenzhen MSU-BIT University, China(广东机器感知与智能计算实验室,工程学院,深圳MSU-BIT大学,中国)

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏