arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-08-12 至 2025-08-12 共收录 282 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 31 篇

2508.07577 2025-08-12 cs.CV cs.LG 74%

Exploiting Layer Normalization Fine-tuning in Visual Transformer Foundation Models for Classification

Zhaorui Tan, Tan Pan, Kaizhu Huang, Weimiao Yu, Kai Yao, Chen Jiang, Qiufeng Wang, Anh Nguyen, Xin Guo, Yuan Cheng, Xi Yang

机构 * Shanghai Academy of Artificial Intelligence for Science(上海人工智能科学研究院) Xi’an Jiaotong-Liverpool University(西安交通大学利物浦大学) University of Liverpool(利物浦大学) AI 3 Fudan University(复旦大学) Duke Kunshan University(杜克-昆山大学) BII, A ∗ STAR Zhejiang University(浙江大学)

专题命中 指令微调 :foundation model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05148 2025-08-12 cs.CV cs.AI cs.LG 73%

LoRA.rar: Learning to Merge LoRAs via Hypernetworks for Subject-Style Conditioned Image Generation

Donald Shenaj, Ondrej Bohdal, Mete Ozay, Pietro Zanuttigh, Umberto Michieli

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments ICCV 2025. Project page: https://donaldssh.github.io/LoRA.rar

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07075 2025-08-12 cs.LG cs.AI 73%

Surgical Knowledge Rewrite in Compact LLMs: An 'Unlearn-then-Learn' Strategy with ($IA^3$) for Localized Factual Modulation and Catastrophic Forgetting Mitigation

Stanley Ngugi

机构 * Stanley Ngugi(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 pages, 2 visual aids

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08011 2025-08-12 cs.CL 70%

Progressive Depth Up-scaling via Optimal Transport

Mingzi Cao, Xi Wang, Nikolaos Aletras

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07466 2025-08-12 cs.AI 70%

Grounding Natural Language for Multi-agent Decision-Making with Multi-agentic LLMs

Dom Huh, Prasant Mohapatra

机构 * UC Davis(加州大学戴维斯分校) University of South Florida(佛罗里达州立大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08780 2025-08-12 cs.IR cs.LG 70%

How Relevance Emerges: Interpreting LoRA Fine-Tuning in Reranking LLMs

Atharva Nijasure, Tanya Chowdhury, James Allan

机构 * Center for Intelligent Information Retrieval, Manning College of Information and Computer Sciences, University of Massachusetts Amherst(智能信息检索中心,信息与计算机科学学院,马萨诸塞大学阿姆赫斯特分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Extended Abstract

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06953 2025-08-12 cs.LG 70%

BoRA: Towards More Expressive Low-Rank Adaptation with Block Diversity

Shiwei Li, Xiandi Luo, Haozhao Wang, Xing Tang, Ziqiang Cui, Dugang Liu, Yuhua Li, Xiuqiang He, Ruixuan Li

机构 * Huazhong University of Science and Technology(华中科技大学) Shenzhen Technology University(深圳技术大学) City University of Hong Kong(香港城市大学) Shenzhen University(深圳大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07804 2025-08-12 cs.CV 67%

Pose-RFT: Enhancing MLLMs for 3D Pose Generation via Hybrid Action Reinforcement Fine-Tuning

Bao Li, Xiaomei Zhang, Miao Xu, Zhaoxin Fan, Xiangyu Zhu, Zhen Lei

机构 * CASIA(中国科学院自动化研究所) UCAS(中国科学院大学) CAIR, HKISI, CAS(中国科学院自动化研究所) Beihang University(北京航空航天大学)

专题命中 指令微调 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22357 2025-08-12 math.OC 67%

Zeroth-order Stochastic Cubic Newton Method Revisited

Yu Liu, Weibin Peng, Tianyu Wang, Jiajia Yu

专题命中 指令微调 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23870 2025-08-12 cs.LG cs.AI 62%

MaCP: Minimal yet Mighty Adaptation via Hierarchical Cosine Projection

Yixian Shen, Qi Bi, Jia-Hong Huang, Hongyi Zhu, Andy D. Pimentel, Anuj Pathania

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

Comments This work was intended as a replacement of arXiv:2410.09103 and any subsequent updates will appear there

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13811 2025-08-12 cs.LG cs.CL 62%

On the Duality between Gradient Transformations and Adapters

Lucas Torroba-Hennigen, Hunter Lang, Han Guo, Yoon Kim

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.LG

Comments 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09103 2025-08-12 cs.LG cs.AI 62%

MaCP: Minimal yet Mighty Adaptation via Hierarchical Cosine Projection

Yixian Shen, Qi Bi, Jia-Hong Huang, Hongyi Zhu, Andy D. Pimentel, Anuj Pathania

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.AI、cs.LG

Comments 17 pages; Previously this version appeared as arXiv:2505.23870 which was submitted as a new work by accident

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07139 2025-08-12 cs.CR cs.AI 57%

A Real-Time, Self-Tuning Moderator Framework for Adversarial Prompt Detection

Ivan Zhang

机构 * CMU(卡内基梅隆大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03733 2025-08-12 cs.CL 57%

WebGen-Bench: Evaluating LLMs on Generating Interactive and Functional Websites from Scratch

Zimu Lu, Yunqiao Yang, Houxing Ren, Haotian Hou, Han Xiao, Ke Wang, Weikang Shi, Aojun Zhou, Mingjie Zhan, Hongsheng Li

机构 * Multimedia Laboratory (MMLab), The Chinese University of Hong Kong(香港中文大学多媒体实验室)

专题命中 指令微调 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06880 2025-08-12 cs.CL cs.IR 57%

The ReQAP System for Question Answering over Personal Information

Philipp Christmann, Gerhard Weikum

机构 * Max Planck Institute for Informatics(马克斯·普朗克研究所信息学研究所)

专题命中 指令微调 :language model(abstract);分类 cs.CL

Comments Accepted at CIKM 2025 (demonstration paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11988 2025-08-12 cs.CR 50%

TechniqueRAG: Retrieval Augmented Generation for Adversarial Technique Annotation in Cyber Threat Intelligence Text

Ahmed Lekssays, Utsav Shukla, Husrev Taha Sencar, Md Rizwan Parvez

专题命中 指令微调 :LLM(abstract)

Comments Accepted at ACL (Findings) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 后训练与偏好优化 5 篇

2506.23998 2025-08-12 cs.CL 90%

Auto-TA: Towards Scalable Automated Thematic Analysis (TA) via Multi-Agent Large Language Models with Reinforcement Learning

Seungjun Yi, Joakim Nguyen, Huimin Xu, Terence Lim, Andrew Well, Mia Markey, Ying Ding

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);LLM(abstract);RLHF(abstract)

Comments Presented at ACL 2025 SRW

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07768 2025-08-12 cs.LG cs.AI cs.CL 87%

Pareto Multi-Objective Alignment for Language Models

Qiang He, Setareh Maghsudi

机构 * Ruhr University Bochum(鲁尔大学波恩)

专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ECML/PKDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00624 2025-08-12 cs.CV 85%

VideoSAVi: Self-Aligned Video Language Models without Human Supervision

Yogesh Kulkarni, Pooyan Fazli

机构 * Arizona State University(亚利桑那州立大学)

专题命中 后训练与偏好优化 :language model(title,abstract);large language model(abstract);preference optimization(abstract)

Comments COLM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08220 2025-08-12 cs.CV 67%

Learning User Preferences for Image Generation Model

Wenyi Mo, Ying Ba, Tianyu Zhang, Yalong Bai, Biye Li

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06924 2025-08-12 cs.CV 67%

AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning

Shihao Yuan, Yahui Liu, Yang Yue, Jingyuan Zhang, Wangmeng Zuo, Qi Wang, Fuzheng Zhang, Guorui Zhou

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract)

Comments 27 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 长上下文与记忆 10 篇

2412.09919 2025-08-12 cs.CV cs.AI 88%

B-VLLM: A Vision Large Language Model with Balanced Spatio-Temporal Tokens

Zhuqiang Lu, Zhenfei Yin, Mengwei He, Zhihui Wang, Zicheng Liu, Zhiyong Wang, Kun Hu

机构 * School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) Department of Engineering Science, University of Oxford(牛津大学工程科学系) International School of Information Science and Engineering, Dalian University of Technology(大连理工大学信息科学与工程国际学院) Advanced Micro Devices(先进微器件公司) School of Science, Edith Cowan University(埃迪斯科文大学科学学院)

专题命中 长上下文与记忆 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments Accepted by ICCV2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06926 2025-08-12 cs.SE 87%

Integrating Rules and Semantics for LLM-Based C-to-Rust Translation

Feng Luo, Kexing Ji, Cuiyun Gao, Shuzheng Gao, Jia Feng, Kui Liu, Xin Xia, Michael R. Lyu

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted in ICSME 25 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07664 2025-08-12 cs.HC 85%

Understanding Users' Privacy Perceptions Towards LLM's RAG-based Memory

Shuning Zhang, Rongjun Ma, Ying Ma, Shixuan Li, Yiqun Xu, Xin Yi, Hewu Li

专题命中 长上下文与记忆 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07026 2025-08-12 quant-ph 82%

Bridging Classical and Quantum Computing for Next-Generation Language Models

Yi Pan, Hanqi Jiang, Junhao Chen, Yiwei Li, Huaqin Zhao, Lin Zhao, Yohannes Abate, Yingfeng Wang, Tianming Liu

专题命中 长上下文与记忆 :language model(title,abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07479 2025-08-12 cs.CL 78%

Positional Biases Shift as Inputs Approach Context Window Limits

Blerta Veseli, Julian Chibane, Mariya Toneva, Alexander Koller

机构 * Saarland Informatics Campus, Saarland University, Germany(萨尔兰大学信息学校区) Max Planck Institute for Informatics, Saarland Informatics Campus, Germany(马克斯·普朗克信息研究所) Max Planck Institute for Software Systems, Saarland Informatics Campus, Germany(马克斯·普朗克软件系统研究所)

专题命中 长上下文与记忆 :language model(abstract,journal_ref);LLM(abstract);large language model(abstract);分类 cs.CL

Journal ref Conference on Language Modeling (COLM) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06755 2025-08-12 cs.CL cs.AI 73%

Many-Turn Jailbreaking

Xianjun Yang, Liqiang Xiao, Shiyang Li, Faisal Ladhak, Hyokun Yun, Linda Ruth Petzold, Yi Xu, William Yang Wang

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07010 2025-08-12 cs.MM cs.HC cs.MA 67%

Narrative Memory in Machines: Multi-Agent Arc Extraction in Serialized TV

Roberto Balestri, Guglielmo Pescatore

专题命中 长上下文与记忆 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02484 2025-08-12 cs.AI cs.LG cs.MA physics.chem-ph 62%

El Agente: An Autonomous Agent for Quantum Chemistry

Yunheng Zou, Austin H. Cheng, Abdulrahman Aldossary, Jiaru Bai, Shi Xuan Leong, Jorge Arturo Campos-Gonzalez-Angulo, Changhyeok Choi, Cher Tian Ser, Gary Tom, Andrew Wang, Zijian Zhang, Ilya Yakavets, Han Hao, Chris Crebolder, Varinia Bernales, Alán Aspuru-Guzik

专题命中 长上下文与记忆 :LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04377 2025-08-12 cs.CV cs.CL cs.MM 57%

Multi-Modal Semantic Parsing for the Interpretation of Tombstone Inscriptions

Xiao Zhang, Johan Bos

机构 * University of Groningen(格罗宁根大学)

专题命中 长上下文与记忆 :language model(abstract);分类 cs.CL

Comments ACMMM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏