arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-30 至 2025-07-30 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 18 篇

2507.21274 2025-07-30 cs.LG 89%

Large Language Model-Enhanced Reinforcement Learning for Diverse and Novel Recommendations

Jiin Woo, Alireza Bagheri Garakani, Tianchen Zhou, Zhishen Huang, Yan Gao

机构 * Carnegie Mellon University(卡内基梅隆大学) Amazon(亚马逊)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21084 2025-07-30 cs.CL cs.LG 86%

Reviving Your MNEME: Predicting The Side Effects of LLM Unlearning and Fine-Tuning via Sparse Model Diffing

Aly M. Kassem, Zhuan Shi, Negar Rostamzadeh, Golnoosh Farnadi

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16491 2025-07-30 cs.CL 85%

BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data

Wenkai Li, Jiarui Liu, Andy Liu, Xuhui Zhou, Mona Diab, Maarten Sap

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)

专题命中 指令微调 :LLM(title,abstract);preference optimization(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18013 2025-07-30 cs.CL 84%

Technical Report of TeleChat2, TeleChat2.5 and T1

Zihan Wang, Xinzhang Liu, Yitong Yao, Chao Wang, Yu Zhao, Zhihao Yang, Wenmin Deng, Kaipeng Jia, Jiaxin Peng, Yuyao Huang, Sishi Xiong, Zhuo Jiang, Kaidong Yu, Xiaohui Hu, Fubei Yao, Ruiyu Fang, Zhuoru Jiang, Ruiting Song, Qiyi Xie, Rui Xue, Xuewei He, Yanlei Xue, Zhu Yuan, Zhaoxi Zhang, Zilu Huang, Shiquan Wang, Xin Wang, Hanming Wu, Mingyuan Wang, Xufeng Zhan, Yuhan Sun, Zhaohu Xing, Yuhao Jiang, Bingkai Yang, Shuangyong Song, Yongxiang Li, Zhongjiang He, Xuelong Li

专题命中 指令微调 :language model(abstract);pretraining(abstract);post-training(abstract);SFT(abstract)

Comments 32 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21899 2025-07-30 cs.AI cs.LG cs.SE 84%

LLM-based Content Classification Approach for GitHub Repositories by the README Files

Malik Uzair Mehmood, Shahid Hussain, Wen Li Wang, Muhammad Usama Malik

机构 * Department of Computing and Built Environment(计算与环境系) Birmingham City University(伯明翰城市大学) Department of Computer Science and Software Engineering(计算机科学与软件工程系) School of Engineering(工程学院) Penn State University, Behrend, Erie PA(宾夕法尼亚州立大学贝伦分校,埃里普斯帕州) Department of Electrical Engineering(电气工程系) UET Taxila(塔希尔工程大学)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 8 pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21706 2025-07-30 q-bio.GN cs.AI 79%

EnTao-GPM: DNA Foundation Model for Predicting the Germline Pathogenic Mutations

Zekai Lin, Haoran Sun, Yucheng Guo, Yujie Yang, Yanwen Wang, Bozhen Hu, Chonghang Ye, Qirong Yang, Fan Zhong, Xiaoming Zhang, Lei Liu

机构 * School of Basic Medical Science, Shanghai Medical College, Fudan University(复旦大学基础医学院) Intelligent Medicine Institute, Fudan University(复旦大学智能医学研究院) BioMap Research(BioMap研究所) Shanghai Institute of Infectious Disease and Biosecurity, Fudan University(复旦大学上海传染病与生物安全研究院) Shanghai Institute of Stem Cell Research and Clinical Translation(上海干细胞研究与临床转化研究院)

专题命中 指令微调 :foundation model(title);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21637 2025-07-30 cs.AI 79%

Self-Aware Safety Augmentation: Leveraging Internal Semantic Understanding to Enhance Safety in Vision-Language Models

Wanying Wang, Zeyu Ma, Han Zheng, Xin Tan, Mingang Chen

机构 * Shanghai Key Laboratory of Computer Software Testing and Evaluating(上海软件测试与评估 key laboratory) Shanghai Normal University(上海Normal University) TrustAI Pte. Ltd. East China Normal University(东华师范大学)

专题命中 指令微调 :language model(title,abstract);分类 cs.AI

Comments Accepted by ACM Multimedia 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19847 2025-07-30 cs.CV 78%

Knowledge Regularized Negative Feature Tuning of Vision-Language Models for Out-of-Distribution Detection

Wenjie Zhu, Yabin Zhang, Xin Jin, Wenjun Zeng, Lei Zhang

机构 * Hong Kong Polytechnic University(香港理工大学) Eastern Institute of Technology(东部技术研究所) Stanford University(斯坦福大学) Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究所,东部技术研究所) Institute for Clarity in Documentation(文档清晰研究所) Inria Paris-Rocquencourt(巴黎-罗克琴堡研究所) Rajiv Gandhi University(拉贾·甘地大学) Tsinghua University(清华大学) Palmer Research Laboratories(帕勒研究实验室)

专题命中 指令微调 :language model(title,abstract)

Comments accepted by ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15582 2025-07-30 cond-mat.mtrl-sci 78%

Fine-tuning foundation models of materials interatomic potentials with frozen transfer learning

Mariia Radova, Wojciech G. Stark, Connor S. Allen, Reinhard J. Maurer, Albert P. Bartók

专题命中 指令微调 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22037 2025-07-30 cs.CR cs.AI 77%

Secure Tug-of-War (SecTOW): Iterative Defense-Attack Training with Reinforcement Learning for Multimodal Model Security

Muzhi Dai, Shixuan Liu, Zhiyuan Zhao, Junyu Gao, Hao Sun, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom, China(人工智能研究院(TeleAI),中国电信,中国) Northwestern Polytechnical University(西北工业大学) China Telecom, China(中国电信,中国)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);分类 cs.AI

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21929 2025-07-30 cs.AI 77%

Libra: Large Chinese-based Safeguard for AI Content

Ziyang Chen, Huimu Yu, Xing Wu, Dongqin Liu, Songlin Hu

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21182 2025-07-30 cs.CR cs.AI 77%

SDD: Self-Degraded Defense against Malicious Fine-tuning

Zixuan Chen, Weikai Lu, Xin Lin, Ziqian Zeng

机构 * Zixuan Chen(陈子轩) Weikai Lu(卢伟凯) Xin Lin(林鑫) Ziqian Zeng(曾子谦)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21099 2025-07-30 cs.CL 70%

Rewrite-to-Rank: Optimizing Ad Visibility via Retrieval-Aware Text Rewriting

Chloe Ho, Ishneet Sukhvinder Singh, Diya Sharma, Tanvi Reddy Anumandla, Michael Lu, Vasu Sharma, Kevin Zhu

机构 * University of Oxford, Oxford, England(牛津大学) University of Berkeley, Berkeley, CA, USA(伯克利大学) Carnegie Mellon University, Pittsburgh, PA, USA(卡内基梅隆大学) Algoverse AI Research, Remote(Algoverse AI研究)

专题命中 指令微调 :LLM(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21056 2025-07-30 cs.DB cs.AI 70%

AI-Driven Generation of Data Contracts in Modern Data Engineering Systems

Harshraj Bhoite

机构 * Senior Member, IEEE(IEEE高级成员) Senior Data and AI Specialist, LTIMindtree.com(LTIMindtree公司高级数据与人工智能专家)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16418 2025-07-30 cs.CV cs.LG 70%

InfiniteYou: Flexible Photo Recrafting While Preserving Your Identity

Liming Jiang, Qing Yan, Yumin Jia, Zichuan Liu, Hao Kang, Xin Lu

机构 * ByteDance Intelligent Creation Project(字节跳动智能创作项目)

专题命中 指令微调 :pretraining(abstract);SFT(abstract);分类 cs.LG

Comments ICCV 2025 (Highlight). Project page: https://bytedance.github.io/InfiniteYou/ Code and model: https://github.com/bytedance/InfiniteYou

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21095 2025-07-30 cs.CL 57%

QU-NLP at CheckThat! 2025: Multilingual Subjectivity in News Articles Detection using Feature-Augmented Transformer Models with Sequential Cross-Lingual Fine-Tuning

Mohammad AL-Smadi

机构 * Qatar University(卡塔尔大学)

专题命中 指令微调 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17294 2025-07-30 cs.RO cs.LG 57%

VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback

Jianxin Bi, Kevin Yuchen Ma, Ce Hao, Mike Zheng Shou, Harold Soh

专题命中 指令微调 :language model(abstract);分类 cs.LG

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13568 2025-07-30 cs.CV 50%

LoRA-Loop: Closing the Synthetic Replay Cycle for Continual VLM Learning

Kaihong Wang, Donghyun Kim, Margrit Betke

机构 * Waymo Boston University(波士顿大学) Korea University(韩国大学)

专题命中 指令微调 :language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏