arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-21 至 2025-10-21 共收录 356 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 40 篇

2510.15962 2025-10-21 cs.LG cs.AI 88%

CTR-LoRA: Curvature-Aware and Trust-Region Guided Low-Rank Adaptation for Large Language Models

Zhuxuanzi Wang, Mingqiao Mo, Xi Xiao, Chen Liu, Chenrui Ma, Yunbei Zhang, Xiao Wang, Smita Krishnaswamy, Tianyang Wang

机构 * Cornell University(康奈尔大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Oak Ridge National Laboratory(橡树岭国家实验室) Yale University(耶鲁大学) University of California, Irvine(加州大学欧文分校) Tulane University(路易斯安那大学塔兰帕伊斯分校)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16604 2025-10-21 cs.CL 88%

Fine-tuning of Large Language Models for Constituency Parsing Using a Sequence to Sequence Approach

Francisco Jose Cortes Delgado, Eduardo Martinez Gracia, Rafael Valencia Garcia

机构 * University of Murcia(穆尔西亚大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments 6 pages, 3 figures. Submitted to SEPLN 2023 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16359 2025-10-21 cs.CL 88%

Utilising Large Language Models for Generating Effective Counter Arguments to Anti-Vaccine Tweets

Utsav Dhanuka, Soham Poddar, Saptarshi Ghosh

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments 14 pages, 1 figure, work done as a part of B.Tech project at IIT Kharagpur

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17274 2025-10-21 cs.CV 88%

Enhanced Motion Forecasting with Plug-and-Play Multimodal Large Language Models

Katie Luo, Jingwei Ji, Tong He, Runsheng Xu, Yichen Xie, Dragomir Anguelov, Mingxing Tan

机构 * Computer and Information Sciences Department, Cornell University(康奈尔大学计算机与信息科学系) Waymo LLC(Waymo公司) UC Berkeley(伯克利大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments In proceedings of IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15993 2025-10-21 q-fin.PM cs.LG q-fin.ST 85%

Aligning Language Models with Investor and Market Behavior for Financial Recommendations

Fernando Spadea, Oshani Seneviratne

机构 * Rensselaer Polytechnic Institute(拉特兰理工学院)

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16984 2025-10-21 cs.LG cs.CL 85%

UFT: Unifying Supervised and Reinforcement Fine-Tuning

Mingyang Liu, Gabriele Farina, Asuman Ozdaglar

专题命中 指令微调 :large language model(abstract);language model(abstract);small language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13636 2025-10-21 cs.LG cs.AI cs.GT 84%

Incentivizing Truthful Language Models via Peer Elicitation Games

Baiting Chen, Tong Zhu, Jiale Han, Lexin Li, Gang Li, Xiaowu Dai

机构 * UCLA(加州大学洛杉矶分校) UC Berkeley(伯克利大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05391 2025-10-21 cs.CL cs.AI 84%

Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences

Guillem Ramírez, Alexandra Birch, Ivan Titov

机构 * ILCC, University of Edinburgh(爱丁堡大学ILCC) ILLC, University of Amsterdam(阿姆斯特丹大学ILLC)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20999 2025-10-21 cs.LG cs.AI 84%

MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning

Yupeng Chen, Senmiao Wang, Yushun Zhang, Zhihang Lin, Haozhe Zhang, Weijian Sun, Tian Ding, Ruoyu Sun

机构 * The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)) Shenzhen Research Institute of Big Data(深圳大数据研究院) Huawei Technologies Co.,Ltd, China(华为技术有限公司) Shenzhen International Center for Industrial and Applied Mathematics(深圳国际工业与应用数学中心)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16022 2025-10-21 cs.LG cs.SE 83%

Breaking Memorization Barriers in LLM Code Fine-Tuning via Information Bottleneck for Improved Generalization

Changsheng Wang, Xin Chen, Sijia Liu, Ke Ding

机构 * The OPTML Lab, Michigan State University(密歇根州立大学OPTML实验室) Intel(英特尔) IBM Research(IBM研究)

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11408 2025-10-21 cs.CL 83%

Valid Survey Simulations with Limited Human Data: The Roles of Prompting, Fine-Tuning, and Rectification

Stefan Krsteski, Giuseppe Russo, Serina Chang, Robert West, Kristina Gligorić

机构 * EPFL(苏黎世联邦理工学院) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校) Johns Hopkins University(约翰霍普金斯大学)

专题命中 指令微调 :prompting(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 19 pages, 4 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09992 2025-10-21 cs.CL cs.LG 82%

Large Language Diffusion Models

Shen Nie, Fengqi Zhu, Zebin You, Xiaolu Zhang, Jingyang Ou, Jun Hu, Jun Zhou, Yankai Lin, Ji-Rong Wen, Chongxuan Li

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Beijing Key Laboratory of Research on Large Models and Intelligent Governance(北京大型模型与智能治理研究重点实验室) Engineering Research Center of Next-Generation Intelligent Search and Recommendation, MOE(下一代智能搜索与推荐工程研究中心) Ant Group(蚂蚁集团)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16776 2025-10-21 cs.CV cs.AI 81%

EMRRG: Efficient Fine-Tuning Pre-trained X-ray Mamba Networks for Radiology Report Generation

Mingzheng Zhang, Jinfeng Gao, Dan Xu, Jiangrui Yu, Yuhan Qiao, Lan Chen, Jin Tang, Xiao Wang

机构 * School of Computer Science and Technology, Anhui University(计算机科学与技术学院,安徽大学) School of Electronic and Information Engineering, Anhui University(电子与信息工程学院,安徽大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16670 2025-10-21 cs.CL cs.AI cs.LG 80%

All You Need is One: Capsule Prompt Tuning with a Single Vector

Yiyang Liu, James C. Liang, Heng Fan, Wenhao Yang, Yiming Cui, Xiaotian Han, Lifu Huang, Dongfang Liu, Qifan Wang, Cheng Han

机构 * University of Missouri-Kansas City(密苏里大学堪萨斯城分校) U.S. Naval Research Laboratory(美国海军研究实验室) University of North Texas(北卡罗来纳州立大学) Lamar University(拉马尔大学) ByteDance(字节跳动) Case Western Reserve University(凯斯西储大学) University of California, Davis(加州大学戴维斯分校) Rochester Institute of Technology(罗切斯特理工学院) Meta AI

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16014 2025-10-21 cs.LG 79%

STAR: Boosting Time Series Foundation Models for Anomaly Detection through State-aware Adapter

Hanyin Cheng, Ruitong Zhang, Yuning Lu, Peng Chen, Meng Wang, Yang Shu, Bin Yang, Chenjuan Guo

机构 * East China Normal University(华东师范大学) APPLab, Huawei(2012 APPLab,华为)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16555 2025-10-21 cs.AI cs.LG 79%

Urban-R1: Reinforced MLLMs Mitigate Geospatial Biases for Urban General Intelligence

Qiongyan Wang, Xingchen Zou, Yutian Jiang, Haomin Wen, Jiaheng Wei, Qingsong Wen, Yuxuan Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Carnegie Mellon University(卡内基梅隆大学) Squirrel Ai Learning

专题命中 指令微调 :foundation model(abstract);post-training(abstract);SFT(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17165 2025-10-21 cs.CE q-fin.TR 78%

Trading with the Devil: Risk and Return in Foundation Model Strategies

Jinrui Zhang

专题命中 指令微调 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17157 2025-10-21 cs.CV cs.AI 77%

GACO-CAD: Geometry-Augmented and Conciseness-Optimized CAD Model Generation from Single Image

Yinghui Wang, Xinyu Zhang, Peng Du

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22967 2025-10-21 cs.CV cs.LG cs.MM 77%

ActAlign: Zero-Shot Fine-Grained Video Classification via Language-Guided Sequence Alignment

Amir Aghdam, Vincent Tao Hu, Björn Ommer

机构 * Department of Computer Science, Temple University(Temple大学计算机科学系) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments Accepted to TMLR 2025 - Project page: https://amir-aghdam.github.io/act-align/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16255 2025-10-21 cs.CR cs.AI 77%

Detecting Adversarial Fine-tuning with Auditing Agents

Sarah Egler, John Schulman, Nicholas Carlini

机构 * MATS & Anthropic Fellows Program(MATS与Anthropic Fellow项目) Thinking Machines Lab(Thinking Machines实验室) Anthropic

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20859 2025-10-21 cs.CL 77%

Concise and Sufficient Sub-Sentence Citations for Retrieval-Augmented Generation

Guo Chen, Qiuyuan Li, Qiuxian Li, Hongliang Dai, Xiang Chen, Piji Li

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17354 2025-10-21 cs.CL cs.AI cs.IR cs.LG 75%

Towards Mixed-Modal Retrieval for Universal Retrieval-Augmented Generation

Chenghao Zhang, Guanting Dong, Xinyu Yang, Zhicheng Dou

机构 * Renmin University of China(中国人民大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This work is in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01879 2025-10-21 cs.MM cs.CV cs.SD eess.AS 75%

Nexus: An Omni-Perceptive And -Interactive Model for Language, Audio, And Vision

Che Liu, Yingji Zhang, Dong Zhang, Weijie Zhang, Chenggong Gong, Yu Lu, Shilin Zhou, Ziliang Gan, Ziao Wang, Haipang Wu, Ji Liu, André Freitas, Qifan Wang, Zenglin Xu, Rongjuncheng Zhang, Yong Dai

机构 * Imperial College London(伦敦帝国学院) University of Manchester(曼彻斯特大学) HiThink Research(HiThink研究院) Soochow University(苏州大学) Hong Kong Baptist University(香港 Baptist大学) Idiap Research Institute(Idiap研究 institute) Meta AI Fudan University(复旦大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Project: https://github.com/HiThink-Research/NEXUS-O

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15964 2025-10-21 cs.LG cs.AI cs.CL 75%

Long Exposure: Accelerating Parameter-Efficient Fine-Tuning for LLMs under Shadowy Sparsity

Tuowei Wang, Kun Li, Zixu Hao, Donglin Bai, Ju Ren, Yaoxue Zhang, Ting Cao, Mao Yang

机构 * Microsoft Research(微软研究院) Tsinghua University(清华大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Proceedings of the International Conference for High Performance Computing, Networking, Storage and Analysis, SC 2024, IEEE Press, Article 75, pp. 1-18, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04863 2025-10-21 cs.LG q-bio.BM 74%

OneProt: Towards Multi-Modal Protein Foundation Models

Klemens Flöge, Srisruthi Udayakumar, Johanna Sommer, Marie Piraud, Stefan Kesselheim, Vincent Fortuin, Stephan Günneman, Karel J van der Weg, Holger Gohlke, Erinc Merdivan, Alina Bazarova

专题命中 指令微调 :foundation model(title);分类 cs.LG

Comments 34 pages, 7 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16411 2025-10-21 cs.LG cs.AI 73%

Modeling Expert Interactions in Sparse Mixture of Experts via Graph Structures

Minh-Khoi Nguyen-Nhat, Rachel S. Y. Teo, Laziz Abdullaev, Maurice Mok, Viet-Hoang Tran, Tan Minh Nguyen

机构 * National University of Singapore(新加坡国立大学)

专题命中 指令微调 :language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01600 2025-10-21 cs.CL cs.AI 73%

A Comparison of Independent and Joint Fine-tuning Strategies for Retrieval-Augmented Generation

Neal Gregory Lawton, Alfy Samuel, Anoop Kumar, Daben Liu

机构 * CapitalOne

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17010 2025-10-21 cs.LG cs.AI stat.ML 73%

Understanding Prompt Tuning and In-Context Learning via Meta-Learning

Tim Genewein, Li Kevin Wenliang, Jordi Grau-Moya, Anian Ruoss, Laurent Orseau, Marcus Hutter

机构 * Google DeepMind(谷歌DeepMind)

专题命中 指令微调 :pretraining(abstract);prompting(abstract);分类 cs.AI、cs.LG

Comments Accepted and presented at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04650 2025-10-21 cs.LG 70%

Neural Network Reprogrammability: A Unified Theme on Model Reprogramming, Prompt Tuning, and Prompt Instruction

Zesheng Ye, Chengyi Cai, Ruijiang Dong, Jianzhong Qi, Lei Feng, Pin-Yu Chen, Feng Liu

专题命中 指令微调 :foundation model(abstract);prompting(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22827 2025-10-21 cs.CV 67%

ScreenCoder: Advancing Visual-to-Code Generation for Front-End Automation via Modular Multimodal Agents

Yilei Jiang, Yaozhi Zheng, Yuxuan Wan, Jiaming Han, Qunzhong Wang, Michael R. Lyu, Xiangyu Yue

机构 * CUHK(香港中文大学) MMLab(多模态实验室) ARISE Lab(ARISE实验室)

专题命中 指令微调 :large language model(abstract);language model(abstract)

Comments ScreenCoder-v2

详情

展开后加载摘要…

URL PDF HTML 收藏