arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-25 至 2025-08-25 共收录 20 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 20 篇

2508.16478 2025-08-25 cs.CL cs.IR 91%

LLM-as-classifier: Semi-Supervised, Iterative Framework for Hierarchical Text Classification using Large Language Models

Doohee You, Andy Parisi, Zach Vander Velden, Lara Dantas Inojosa

机构 * Google(谷歌)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.CL

Comments 20 pages excluding reference list, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15805 2025-08-25 cs.CL cs.AI cs.LG 89%

ALAS: Autonomous Learning Agent for Self-Updating Language Models

Dhruv Atreja

机构 * Dhruv Atreja(独立研究者)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16243 2025-08-25 cs.CL 89%

TULIP: Adapting Open-Source Large Language Models for Underrepresented Languages and Specialized Financial Tasks

İrem Demirtaş, Burak Payzun, Seçil Arslan

机构 * Data Science & AI, Prometeia SPA(数据科学与人工智能,Prometeia公司)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL

Comments IJCAI 2025 - FinLLM Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15361 2025-08-25 cs.LG 89%

Decentralized Low-Rank Fine-Tuning of Large Language Models

Sajjad Ghiasvand, Mahnoosh Alizadeh, Ramtin Pedarsani

机构 * Electrical and Computer Engineering Department, UC Santa Barbara(加州大学圣芭芭拉分校电气与计算机工程系)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16054 2025-08-25 cs.AI cs.CL 88%

Generative Foundation Model for Structured and Unstructured Electronic Health Records

Sonish Sivarajkumar, Hang Zhang, Yuelyu Ji, Maneesh Bilalpur, Xizhi Wu, Chenyu Li, Min Gu Kwak, Shyam Visweswaran, Yanshan Wang

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16100 2025-08-25 cs.CL cs.AI cs.LG 87%

CYCLE-INSTRUCT: Fully Seed-Free Instruction Tuning via Dual Self-Training and Cycle Consistency

Zhanming Shen, Hao Chen, Yulei Tang, Shaolin Zhu, Wentao Ye, Xiaomeng Hu, Haobo Wang, Gang Chen, Junbo Zhao

机构 * Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Tianjin University(天津大学)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15854 2025-08-25 cs.CL 85%

QU-NLP at QIAS 2025 Shared Task: A Two-Phase LLM Fine-Tuning and Retrieval-Augmented Generation Approach for Islamic Inheritance Reasoning

Mohammad AL-Smadi

机构 * Qatar University(卡塔尔大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20182 2025-08-25 cs.LG cs.AI q-bio.QM 84%

Chemical Language Model Linker: blending text and molecules with modular adapters

Yifan Deng, Spencer S. Ericksen, Anthony Gitter

机构 * Department of Computer Sciences, University of Wisconsin-Madison(威斯康星大学麦迪逊分校计算机科学系) Drug Development Core, Small Molecule Screening Facility, University of Wisconsin Carbone Cancer Center, University of Wisconsin-Madison(威斯康星大学卡本纳癌症中心药物开发核心、小分子筛选设施) Department of Biostatistics and Medical Informatics, University of Wisconsin-Madison(威斯康星大学麦迪逊分校生物统计学与医学信息学系)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments 63 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06360 2025-08-25 cs.CL 83%

Cyberbullying Detection via Aggression-Enhanced Prompting

Aisha Saeid, Anu Sabu, Girish A. Koushik, Ferrante Neri, Diptesh Kanojia

机构 * NICE Research Group & Institute for People-Centred AI, School of Computer Science & Electronic Engineering, University of Surrey, UK(NICE研究组及以人为本的人工智能研究所、计算机科学与电子工程学院、萨里大学)

专题命中 指令微调 :prompting(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to RANLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16546 2025-08-25 cs.LG cs.AI 82%

RL Is Neither a Panacea Nor a Mirage: Understanding Supervised vs. Reinforcement Learning Fine-Tuning for LLMs

Hangzhan Jin, Sicheng Lv, Sifan Wu, Mohammad Hamdaqa

机构 * PolyTechnique Montreal(蒙特利尔大学) Mila(Mila研究院) McGill(麦吉尔大学) UDeM(UDeM大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15903 2025-08-25 cs.CV 82%

VT-LVLM-AR: A Video-Temporal Large Vision-Language Model Adapter for Fine-Grained Action Recognition in Long-Term Videos

Kaining Li, Shuwei He, Zihan Xu

机构 * Xidian University(西电大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16157 2025-08-25 cs.CV cs.AI 79%

Beyond Human-prompting: Adaptive Prompt Tuning with Semantic Alignment for Anomaly Detection

Pi-Wei Chen, Jerry Chun-Wei Lin, Wei-Han Chen, Jia Ji, Zih-Ching Chen, Feng-Hao Yeh, Chao-Chun Chen

机构 * Silesian University of Technology(西里西亚技术大学) National Cheng Kung University(国立成功大学) Nvidia AI Technology Center(Nvidia AI技术中心)

专题命中 指令微调 :prompting(title);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15876 2025-08-25 cs.CL cs.AI cs.MA 79%

DeepMEL: A Multi-Agent Collaboration Framework for Multimodal Entity Linking

Fang Wang, Tianwei Yan, Zonghao Yang, Minghao Hu, Jun Zhang, Zhunchen Luo, Xiaoying Bai

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) School of Information Science and Engineering, Chongqing Jiaotong University(重庆交通大学信息科学与工程学院) China Research and Development Academy of Machinery Equipment(机械电子研究发展院) Center of Information Research, Academy of Military Science(军事科学信息研究中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16270 2025-08-25 cs.CL 77%

LLMs that Understand Processes: Instruction-tuning for Semantics-Aware Process Mining

Vira Pyrih, Adrian Rebmann, Han van der Aa

机构 * Faculty of Computer Science(计算机科学系) University of Vienna(维也纳大学) SAP Signavio

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at IEEE ICPM 2025, 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01225 2025-08-25 cs.CV cs.AI 74%

Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models

Xinyu Chen, Haotian Zhai, Can Zhang, Xiupeng Shi, Ruirui Li

机构 * Shanghai University(上海大学) Beijing University of Chemical Technology(北京化工大学) University of Minnesota(明尼苏达大学)

专题命中 指令微调 :language model(title);分类 cs.AI

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15820 2025-08-25 cs.CL cs.AI cs.IR 73%

Research on intelligent generation of structural demolition suggestions based on multi-model collaboration

Zhifeng Yang, Peizong Wu

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01819 2025-08-25 cs.LG cs.AI math.OC 62%

Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning

Hanyang Zhao, Haoxian Chen, Ji Zhang, David D. Yao, Wenpin Tang

机构 * StonyBrook(石溪大学)

专题命中 指令微调 :RLHF(abstract);分类 cs.AI、cs.LG

Comments arXiv admin note: text overlap with arXiv:2409.08400

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16429 2025-08-25 cs.CY cs.AI cs.LG 62%

LearnLM: Improving Gemini for Learning

LearnLM Team, Abhinit Modi, Aditya Srikanth Veerubhotla, Aliya Rysbek, Andrea Huber, Brett Wiltshire, Brian Veprek, Daniel Gillick, Daniel Kasenberg, Derek Ahmed, Irina Jurenka, James Cohan, Jennifer She, Julia Wilkowski, Kaiz Alarakyia, Kevin R. McKee, Lisa Wang, Markus Kunesch, Mike Schaekermann, Miruna Pîslar, Nikhil Joshi, Parsa Mahmoudieh, Paul Jhun, Sara Wiltberger, Shakir Mohamed, Shashank Agarwal, Shubham Milind Phal, Sun Jae Lee, Theofilos Strinopoulos, Wei-Jen Ko, Amy Wang, Ankit Anand, Avishkar Bhoopchand, Dan Wild, Divya Pandya, Filip Bar, Garth Graham, Holger Winnemoeller, Mahvish Nagda, Prateek Kolhar, Renee Schneider, Shaojian Zhu, Stephanie Chan, Steve Yadlowsky, Viknesh Sounderajah, Yannis Assael

机构 * Google(谷歌)

专题命中 指令微调 :post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16292 2025-08-25 cs.AI cs.RO 57%

Do What? Teaching Vision-Language-Action Models to Reject the Impossible

Wen-Han Hsieh, Elvis Hsieh, Dantong Niu, Trevor Darrell, Roei Herzig, David M. Chan

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 指令微调 :instruction tuning(abstract);分类 cs.AI

Comments 9 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21935 2025-08-25 physics.comp-ph 50%

Fine-Tuning Universal Machine-Learned Interatomic Potentials: A Tutorial on Methods and Applications

Xiaoqing Liu, Kehan Zeng, Zedong Luo, Yangshuai Wang, Teng Zhao, Zhenli Xu

专题命中 指令微调 :foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏