arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-09 至 2025-09-09 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 24 篇

2509.06052 2025-09-09 cs.SE cs.AI cs.CR 89%

Empirical Study of Code Large Language Models for Binary Security Patch Detection

Qingyuan Li, Binchang Li, Cuiyun Gao, Shuzheng Gao, Zongjie Li

机构 * National Key Laboratory for Novel Software Technology at Nanjing University(南京大学新型软件技术国家重点实验室) Harbin Institute of Technology(哈尔滨工业大学) Chinese University of Hong Kong(香港中文大学) Hong Kong University of Science and Technology(香港科学大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06949 2025-09-09 cs.CL 88%

Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models

Yinjie Wang, Ling Yang, Bowen Li, Ye Tian, Ke Shen, Mengdi Wang

专题命中 指令微调 :language model(title,abstract);large language model(title);post-training(abstract);分类 cs.CL

Comments Code and Models: https://github.com/Gen-Verse/dLLM-RL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10032 2025-09-09 cs.CV 87%

Osprey: Pixel Understanding with Visual Instruction Tuning

Yuqian Yuan, Wentong Li, Jian Liu, Dongqi Tang, Xinjie Luo, Chi Qin, Lei Zhang, Jianke Zhu

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) Microsoft(微软) The HongKong Polytechnical University(香港理工大学)

专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments CVPR2024, Code and Demo link:https://github.com/CircleRadon/Osprey

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06531 2025-09-09 cs.CL cs.AI 86%

SLiNT: Structure-aware Language Model with Injection and Contrastive Training for Knowledge Graph Completion

Mengxue Yang, Chun Yang, Jiaqi Zhu, Jiafan Li, Jingqi Zhang, Yuyang Li, Ying Li

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) National Astronomical Observatories, Chinese Academy of Sciences(中国科学院国家天文台)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06200 2025-09-09 cs.CL 85%

MSLEF: Multi-Segment LLM Ensemble Finetuning in Recruitment

Omar Walid, Mohamed T. Younes, Khaled Shaban, Mai Hassan, Ali Hamdi

机构 * Dept. of Computer Science, Qatar University, Doha, Qatar(计算机科学系,卡塔尔大学,多哈)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted in AICCSA 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05445 2025-09-09 cs.CR cs.DB 85%

Are Your LLM-based Text-to-SQL Models Secure? Exploring SQL Injection via Backdoor Attacks

Meiyu Lin, Haichuan Zhang, Jiale Lao, Renyuan Li, Yuanchun Zhou, Carl Yang, Yang Cao, Mingjie Tang

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted to SIGMOD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06883 2025-09-09 cs.CL cs.AI cs.IR 84%

UNH at CheckThat! 2025: Fine-tuning Vs Prompting in Claim Extraction

Joe Wilder, Nikhil Kadapala, Benji Xu, Mohammed Alsaadi, Aiden Parsons, Mitchell Rogers, Palash Agarwal, Adam Hassick, Laura Dietz

机构 * University of New Hampshire(新罕布什尔大学)

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 16 pages,3 tables, CLEF 2025 Working Notes, 9-12 September 2025, Madrid, Spain

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.06620 2025-09-09 cs.LG cs.AI cs.CL 82%

MedualTime: A Dual-Adapter Language Model for Medical Time Series-Text Multimodal Learning

Jiexia Ye, Weiqi Zhang, Ziyue Li, Jia Li, Meng Zhao, Fugee Tsung

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Hong Kong University of Science and Technology(香港科技大学) Technical University of Munich(慕尼黑技术大学) Columbia University(哥伦比亚大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 9 pages, 6 figure, 3 tables

Journal ref IJCAI 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05899 2025-09-09 cs.LG cs.DB 81%

X-SQL: Expert Schema Linking and Understanding of Text-to-SQL with Multi-LLMs

Dazhi Peng

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15449 2025-09-09 cs.CL cs.LG 81%

Repetition Improves Language Model Embeddings

Jacob Mitchell Springer, Suhas Kotha, Daniel Fried, Graham Neubig, Aditi Raghunathan

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.LG

Comments ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05867 2025-09-09 cs.CL cs.AI 79%

ZhiFangDanTai: Fine-tuning Graph-based Retrieval-Augmented Generation Model for Traditional Chinese Medicine Formula

ZiXuan Zhang, Bowen Hao, Yingjie Li, Hongzhi Yin

机构 * School of Management, Capital Normal University(管理学院,首都师范大学) School of Electrical Engineering and Computer Science, the University of Queensland(电气工程与计算机科学学院,昆士兰大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12856 2025-09-09 cs.LG cs.AI 79%

Supervised Fine Tuning on Curated Data is Reinforcement Learning (and can be improved)

Chongli Qin, Jost Tobias Springenberg

机构 * Independent Research(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

Comments See project website for details and code at: https://independentresearch.ai/posts/iwsft

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06096 2025-09-09 cs.CV 78%

MedSeqFT: Sequential Fine-tuning Foundation Models for 3D Medical Image Segmentation

Yiwen Ye, Yicheng Wu, Xiangde Luo, He Zhang, Ziyang Chen, Ting Dang, Yanning Zhang, Yong Xia

机构 * School of Computer Science and Engineering, Northwestern Polytechnical University(计算机科学与工程学院,西北工业大学) Monash University(墨尔本大学) Department of Radiation Oncology, Sichuan Cancer Hospital(肿瘤医院放射肿瘤科) RMIT(皇家墨尔本理工大学) University of Melbourne(墨尔本大学)

专题命中 指令微调 :foundation model(title,abstract)

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06795 2025-09-09 cs.CL 77%

Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint

Yanrui Du, Fenglei Fan, Sendong Zhao, Jiawei Cao, Qika Lin, Kai He, Ting Liu, Bing Qin, Mengling Feng

机构 * SCIR Lab, Harbin Institute of Technology, China(哈尔滨工业大学SCIR实验室) City University of Hong Kong(香港城市大学) National University of Singapore(新加坡国立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18827 2025-09-09 cs.SE cs.AI 77%

Test It Before You Trust It: Applying Software Testing for Trustworthy In-context Learning

Teeradaj Racharak, Chaiyong Ragkhitwetsagul, Chommakorn Sontesadisai, Thanwadee Sunetnanta

机构 * Advanced Institute of So-Go-Chi (Convergence Knowledge) Informatics(融合知识研究院) Tohoku University(东北大学) Japan Advanced Institute of Science and Technology(日本先进科学研究院) Faculty of Information and Communication Technology(信息与通信技术学院) Mahidol University(玛希敦大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Journal ref Natural Language Processing and Information Systems (NLDB 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05385 2025-09-09 cs.CL cs.AI 73%

A Lightweight Framework for Trigger-Guided LoRA-Based Self-Adaptation in LLMs

Jiacheng Wei, Faguo Wu, Xiao Zhang

机构 * SAGE: A Lightweight Framework for Trigger-Guided LoRA-Based Self-Adaptation in LLMs(SAGE:轻量级框架)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 7 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06807 2025-09-09 cs.CL 70%

MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security

Yanrui Du, Fenglei Fan, Sendong Zhao, Jiawei Cao, Ting Liu, Bing Qin

机构 * SCIR Lab, Harbin Institute of Technology, China(哈尔滨工业大学SCIR实验室) City University of Hong Kong(香港城市大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22823 2025-09-09 cs.CL 70%

Self-Critique and Refinement for Faithful Natural Language Explanations

Yingming Wang, Pepa Atanasova

机构 * University of Copenhagen(哥本哈根大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05695 2025-09-09 cs.CV 67%

Leveraging Vision-Language Large Models for Interpretable Video Action Recognition with Semantic Tokenization

Jingwei Peng, Zhixuan Qiu, Boyu Jin, Surasakdi Siripong

机构 * Tianjin Agricultural University(天津农业大学) Walailak University(Walailak大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13075 2025-09-09 cs.LG 57%

An All-Atom Generative Model for Designing Protein Complexes

Ruizhe Chen, Dongyu Xue, Xiangxin Zhou, Zaixiang Zheng, Xiangxiang Zeng, Quanquan Gu

专题命中 指令微调 :SFT(abstract);分类 cs.LG

Comments updated binder design results

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05989 2025-09-09 astro-ph.SR 50%

Simulation of Solar Surface Flux Transport Constrained by Magnetic Power Spectra. I. Flux Transport Parameter

Yukun Luo, Jie Jiang, Ruihui Wang

专题命中 指令微调 :SFT(abstract)

Comments 15 pages, 6 figures, accepted by ApJ

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.03221 2025-09-09 cs.CV eess.IV 50%

ADIR: Adaptive Diffusion for Image Reconstruction

Shady Abu-Hussein, Tom Tirer, Raja Giryes

机构 * Tel Aviv University(特拉维夫大学) Bar Ilan University(巴伊兰大学)

专题命中 指令微调 :language model(abstract)

Comments Project page https://shadyabh.github.io/ADIR/

Journal ref BMVC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00665 2025-09-09 cs.CV cs.RO 50%

ER-LoRA: Effective-Rank Guided Adaptation for Weather-Generalized Depth Estimation

Weilong Yan, Xin Zhang, Robby T. Tan

机构 * National University of Singapore(新加坡国立大学)

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02554 2025-09-09 math.DS 50%

Factorizable embeddings and the period of an irreducible sofic shift

Brian Marcus, Tom Meyerovitch, Klaus Thomsen, Chengyu Wu

专题命中 指令微调 :SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏