arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-05 至 2025-08-05 共收录 292 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 26 篇

2505.10939 2025-08-05 cs.CL cs.AI 79%

GenKnowSub: Improving Modularity and Reusability of LLMs through General Knowledge Subtraction

Mohammadtaha Bagherifard, Sahar Rajabi, Ali Edalat, Yadollah Yaghoobzadeh

机构 * School of Electrical and Computer Engineering, College of Engineering, University of Tehran, Tehran, Iran(伊朗德黑兰大学电气与计算机工程学院) Tehran Institute for Advanced Studies, Khatam University, Tehran, Iran(德黑兰高级研究学院)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 (main conference, short paper), 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13026 2025-08-05 cs.LG cs.AI 79%

Step-wise Adaptive Integration of Supervised Fine-tuning and Reinforcement Learning for Task-Specific LLMs

Jack Chen, Fazhong Liu, Naruto Liu, Yuhan Luo, Erqu Qin, Harry Zheng, Tian Dong, Haojin Zhu, Yan Meng, Xiao Wang

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01582 2025-08-05 cs.CV 78%

Set Pivot Learning: Redefining Generalized Segmentation with Vision Foundation Models

Xinhui Li, Xinyu He, Qiming Hu, Xiaojie Guo

机构 * College of Intelligence and Computing, Tianjin University(智能与计算学院,天津大学)

专题命中 指令微调 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01361 2025-08-05 cs.RO 78%

VLH: Vision-Language-Haptics Foundation Model

Luis Francisco Moreno Fuentes, Muhammad Haris Khan, Miguel Altamirano Cabrera, Valerii Serpiva, Dmitri Iarchuk, Yara Mahmoud, Issatay Tokmurziyev, Dzmitry Tsetserukou

机构 * Intelligent Space Robotics Laboratory(智能空间机器人实验室) Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究所)

专题命中 指令微调 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01739 2025-08-05 cs.CL 77%

Enhancing the Preference Extractor in Multi-turn Dialogues: From Annotating Disasters to Accurate Preference Extraction

Cheng Wang, ziru Liu, Pengcheng Tang, Mingyu Zhang, Quanyu Dai, Yue Zhu

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司) Huawei Noah’s Ark Lab(华为诺亚实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01059 2025-08-05 cs.CR cs.AI 77%

Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report

Sajana Weerawardhena, Paul Kassianik, Blaine Nelson, Baturay Saglam, Anu Vellore, Aman Priyanshu, Supriti Vijay, Massimo Aufiero, Arthur Goldblatt, Fraser Burch, Ed Li, Jianliang He, Dhruv Kedia, Kojin Oshiba, Zhouran Yang, Yaron Singer, Amin Karbasi

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 34 pages - Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07448 2025-08-05 cs.LG cs.AI cs.CL 75%

LoRI: Reducing Cross-Task Interference in Multi-Task Low-Rank Adaptation

Juzheng Zhang, Jiacheng You, Ashwinee Panda, Tom Goldstein

机构 * University of Maryland(马里兰大学) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02079 2025-08-05 cs.LG cs.AI 73%

AlignGuard-LoRA: Alignment-Preserving Fine-Tuning via Fisher-Guided Decomposition and Riemannian-Geodesic Collision Regularization

Amitava Das, Abhilekh Borah, Vinija Jain, Aman Chadha

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04358 2025-08-05 cs.LG cs.CL 73%

Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation

Ayan Sengupta, Vaibhav Seth, Arinjay Pathak, Aastha Verma, Natraj Raman, Sriram Gopalakrishnan, Niladri Chatterjee, Tanmoy Chakraborty

机构 * Indian Institute of Technology Delhi(印度理工学院德里)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments The paper is accepted in TMLR'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09758 2025-08-05 cs.LG cs.CL 73%

BiDoRA: Bi-level Optimization-Based Weight-Decomposed Low-Rank Adaptation

Peijia Qin, Ruiyi Zhang, Pengtao Xie

机构 * University of California, San Diego(加州大学圣迭戈分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07025 2025-08-05 cs.CV cs.CL 70%

CheXalign: Preference fine-tuning in chest X-ray interpretation models without human feedback

Dennis Hein, Zhihong Chen, Sophie Ostmeier, Justin Xu, Maya Varma, Eduardo Pontes Reis, Arne Edward Michalson, Christian Bluethgen, Hyun Joo Shin, Curtis Langlotz, Akshay S Chaudhari

机构 * Stanford University(斯坦福大学) University of Oxford(牛津大学) University Hospital Zurich, University of Zurich(苏黎世大学医院、苏黎世大学) Yongin Severance Hospital, Yonsei University(永临松医院、延世大学)

专题命中 指令微调 :language model(abstract);post-training(abstract);分类 cs.CL

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02587 2025-08-05 cs.LG cs.AI cs.CL 67%

Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules

Yilun Liu, Yunpu Ma, Yuetian Lu, Shuo Chen, Zifeng Ding, Volker Tresp

机构 * Technical University of Munich(慕尼黑技术大学) Ludwig Maximilian University of Munich(慕尼黑路德维希-马克西米利安大学) University of Cambridge(剑桥大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This paper is a preprint under review. arXiv admin note: text overlap with arXiv:2411.08212

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11435 2025-08-05 cs.CV 67%

GLDesigner: Leveraging Multi-Modal LLMs as Designer for Enhanced Aesthetic Text Glyph Layouts

Junwen He, Yifan Wang, Lijun Wang, Huchuan Lu, Jun-Yan He, Chenyang Li, Hanyuan Chen, Jin-Peng Lan, Bin Luo, Yifeng Geng

机构 * Dalian University of Technology(大连理工大学) Alibaba Group(阿里巴巴集团)

专题命中 指令微调 :language model(abstract);instruction tuning(abstract)

Comments ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01161 2025-08-05 cs.CL 57%

CSIRO-LT at SemEval-2025 Task 11: Adapting LLMs for Emotion Recognition for Multiple Languages

Jiyu Chen, Necva Bölücü, Sarvnaz Karimi, Diego Mollá, Cécile L. Paris

机构 * CSIRO Data61(CSIRO数据61研究所) Macquarie University(麦考瑞大学)

专题命中 指令微调 :LLM(abstract);分类 cs.CL

Comments In Proceedings of the 19th International Workshop on Semantic Evaluation (SemEval-2025), Vienna, Austria. Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.16493 2025-08-05 cs.CL 57%

Learning from Negative Samples in Biomedical Generative Entity Linking

Chanhwi Kim, Hyunjae Kim, Sihyeon Park, Jiwoo Lee, Mujeen Sung, Jaewoo Kang

机构 * Korea University(韩国大学) Kyung Hee University(庆熙大学) AIGEN Sciences(AIGEN公司)

专题命中 指令微调 :preference optimization(abstract);分类 cs.CL

Comments ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 后训练与偏好优化 6 篇

2508.01930 2025-08-05 cs.CL cs.AI 91%

Word Overuse and Alignment in Large Language Models: The Influence of Learning from Human Feedback

Tom S. Juzek, Zina B. Ward

机构 * Florida State University(佛罗里达州立大学)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);preference optimization(abstract)

Comments Accepted for publication in the Proceedings of the 5th Workshop on Bias and Fairness in AI (BIAS 2025) at ECML PKDD

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01174 2025-08-05 cs.LG cs.AI 90%

RSPO: Risk-Seeking Policy Optimization for Pass@k and Max@k Metrics in Large Language Models

Kaichen Zhang, Shenghao Gao, Yuzhong Hong, Haipeng Sun, Junwei Bao, Hongfei Jiang, Yang Song, Hong Dingqian, Hui Xiong

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Zuoyebang Education Technology(左就业教育科技)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20227 2025-08-05 cs.IR 87%

CTR-Driven Ad Text Generation via Online Feedback Preference Optimization

Yanda Chen, Zihui Ren, Qixiang Gao, Jiale Chen, Si Chen, Xubin Li, Tiezheng Ge, Bo Zheng

专题命中 后训练与偏好优化 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 13 pages, 7 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11554 2025-08-05 cs.CV cs.AI 83%

Inversion-DPO: Precise and Efficient Post-Training for Diffusion Models

Zejian Li, Yize Li, Chenye Meng, Zhongni Liu, Yang Ling, Shengyuan Zhang, Guang Yang, Changyuan Yang, Zhiyuan Yang, Lingyun Sun

机构 * Zhejiang University(浙江大学) University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学) Alibaba Group(阿里巴巴集团)

专题命中 后训练与偏好优化 :post-training(title,abstract);preference optimization(abstract);分类 cs.AI

Comments Accepted by ACM MM25

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18661 2025-08-05 cs.CV cs.RO 75%

Eyes Will Shut: A Vision-Based Next GPS Location Prediction Model by Reinforcement Learning from Visual Map Feed Back

Ruixing Zhang, Yang Zhang, Tongyu Zhu, Leilei Sun, Weifeng Lv

专题命中 后训练与偏好优化 :LLM(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00834 2025-08-05 cs.CV 50%

Team PA-VCG's Solution for Competition on Understanding Chinese College Entrance Exam Papers in ICDAR'25

Wei Wu, Wenjie Wang, Yang Tan, Ying Liu, Liang Diao, Lin Huang, Kaihe Xu, Wenfeng Xie, Ziling Lin

机构 * Visual Computing Group, Ping An Property & Casualty Insurance Company(平安财产保险有限公司视觉计算组)

专题命中 后训练与偏好优化 :post-training(abstract)

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 长上下文与记忆 11 篇

2508.00843 2025-08-05 cs.HC cs.AI cs.SE 89%

Generative AI for CAD Automation: Leveraging Large Language Models for 3D Modelling

Sumit Kumar, Sarthak Kapoor, Harsh Vardhan, Yao Zhao

机构 * Georgia State University(佐治亚州立大学) Amazon LLC(亚马逊公司) Vanderbilt University(范德比尔特大学) Temple University(Temple 大学)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02252 2025-08-05 cs.CL 85%

Compressing KV Cache for Long-Context LLM Inference with Inter-Layer Attention Similarity

Da Ma, Lu Chen, Situo Zhang, Yuxun Miao, Su Zhu, Zhi Chen, Hongshen Xu, Hanqi Li, Shuai Fan, Lei Pan, Kai Yu

专题命中 长上下文与记忆 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)

Comments 14 pages, 7 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.12465 2025-08-05 cs.CL cs.LG 84%

Core Context Aware Transformers for Long Context Language Modeling

Yaofo Chen, Zeng You, Shuhai Zhang, Haokun Li, Yirui Li, Yaowei Wang, Mingkui Tan

机构 * South China University of Technology(华南理工大学) Peng Cheng Laboratory(鹏城实验室) Pazhou Laboratory(琶洲实验室) Harbin Institute of Technology(哈尔滨工业大学) Key Laboratory of Big Data and Intelligent Robot, Ministry of Education(教育部大数据与智能机器人重点实验室)

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Accepted for publication at ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15113 2025-08-05 cs.NE cs.AI cs.CL 82%

Associative memory inspires improvements for in-context learning using a novel attention residual stream architecture

Thomas F Burns, Tomoki Fukai, Christopher J Earls

机构 * SciAI Center, Cornell University, USA(SciAI中心,康奈尔大学,美国) Neural Coding and Brain Computing Unit, OIST, Japan(神经编码与脑计算单元,海洋研究所,日本) SciAI Center, Center for Applied Mathematics, School of Civil and Environmental Engineering, Cornell University, USA(SciAI中心,应用数学中心,土木与环境工程学院,康奈尔大学,美国)

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

Comments 35 pages, 14 figures, 6 tables; accepted and published in TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09506 2025-08-05 cs.CL 79%

Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models

Junjie Wu, Gefei Gu, Yanan Zheng, Dit-Yan Yeung, Arman Cohan

机构 * Hong Kong University of Science and Technology(香港理工大学) Carnegie Mellon University(卡内基梅隆大学) Yale University(耶鲁大学)

专题命中 长上下文与记忆 :language model(title,abstract);分类 cs.CL

Comments ACL 2025 Main Conference. First 2 authors contributed equally. Project webpage: https://wujunjie1998.github.io/Ref-Long-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00911 2025-08-05 cs.CY 75%

Mitigating the Carbon Footprint of Chatbots as Consumers

Boris Ruf, Marcin Detyniecki

专题命中 长上下文与记忆 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Published in Lanka, S., Cabezuelo, A.S., Vuppalapati, C. (2025). Trends in Sustainable Computing and Machine Intelligence. Proceedings of ICTSM: International Conference on Trends in Sustainable Computing and Machine Intelligence 2024. Springer, Singapore

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21055 2025-08-05 cs.CY cs.AI cs.SI 74%

Can Memory-Augmented LLM Agents Aid Journalism in Interpreting and Framing News for Diverse Audiences?

Leyi Ouyang

机构 * South China Agriculture University Zhujiang College(华南农业大学珠江学院)

专题命中 长上下文与记忆 :LLM(title);分类 cs.AI

Comments 9 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02401 2025-08-05 cs.CL cs.AI 73%

CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation

Xiaolin Lin, Jingcun Wang, Olga Kondrateva, Yiyu Shi, Bing Li, Grace Li Zhang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19906 2025-08-05 cs.CL 70%

CaliDrop: KV Cache Compression with Calibration

Yi Su, Quantong Qiu, Yuechi Zhou, Juntao Li, Qingrong Xia, Ping Li, Xinyu Duan, Zhefeng Wang, Min Zhang

机构 * School of Computer Science and Technology, Soochow University(1 计算机科学与技术学院,苏州大学) Huawei Cloud(2 华为云)

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏