arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-11-04 至 2025-11-04 共收录 25 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 25 篇

2511.00460 2025-11-04 cs.CR cs.AI 89%

Proactive DDoS Detection and Mitigation in Decentralized Software-Defined Networking via Port-Level Monitoring and Zero-Training Large Language Models

Mohammed N. Swileh, Shengli Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11559 2025-11-04 cs.CL cs.AI 88%

Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models

Yue Xu, Chengyan Fu, Li Xiong, Sibei Yang, Wenjie Wang

机构 * School of Information Science and Technology, ShanghaiTech University(信息科学与技术学院,上海科技大学) Emory University(埃默里大学) Sun Yat-sen University(中山大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22767 2025-11-04 cs.HC cs.AI 88%

In Dialogue with Intelligence: Rethinking Large Language Models as Collective Knowledge

Eleni Vasilaki

机构 * Eleni Vasilaki(独立研究者)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

Comments 7 pages, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07539 2025-11-04 cs.CL 88%

XIFBench: Evaluating Large Language Models on Multilingual Instruction Following

Zhenyu Li, Kehai Chen, Yunfei Long, Xuefeng Bai, Yaoyin Zhang, Xuchen Wei, Juntao Li, Min Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Queen Mary University of London(伦敦大学女王学院) Soochow University(苏州大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted by the NeurIPS 2025 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13790 2025-11-04 cs.CL cs.AI 86%

Teaching According to Talents! Instruction Tuning LLMs with Competence-Aware Curriculum Learning

Yangning Li, Tingwei Lu, Yinghui Li, Yankai Chen, Wei-Chieh Huang, Wenhao Jiang, Hui Wang, Hai-Tao Zheng, Philip S. Yu

机构 * Tsinghua University(清华大学) Peng Cheng Laboratory(鹏城实验室) Cornell University(康奈尔大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校) Guangming Laboratory(光明实验室)

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00365 2025-11-04 cs.LG cs.AI 86%

Low-Rank Adaptation for Foundation Models: A Comprehensive Review

Menglin Yang, Jialin Chen, Jinkai Tao, Yifei Zhang, Jiahong Liu, Jiasheng Zhang, Qiyao Ma, Harshit Verma, Regina Zhang, Min Zhou, Irwin King, Rex Ying

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Yale University(耶鲁大学) Nanyang Technological University(南洋理工大学) Central University of Finance and Economics(中央财经大学) The Chinese University of Hong Kong(香港中文大学) Xi’an University of Electronic Science and Technology(西安电子科技大学) University of California, Davis(加州大学戴维斯分校) The University of Cambridge(剑桥大学) LOGS AI

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00101 2025-11-04 cs.LG cs.AI 86%

Loquetier: A Virtualized Multi-LoRA Framework for Unified LLM Fine-tuning and Serving

Yuchen Zhang, Hanyue Du, Chun Cao, Jingwei Xu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 26 pages including 10 pages of main text, 6 figures, 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15685 2025-11-04 cs.RO 85%

From Grounding to Manipulation: Case Studies of Foundation Model Integration in Embodied Robotic Systems

Xiuchao Sui, Daiying Tian, Qi Sun, Ruirui Chen, Dongkyu Choi, Kenneth Kwok, Soujanya Poria

机构 * IHPC, Agency for Science, Technology and Research, Singapore(科技研究局智能技术中心,新加坡) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments EMNLP 2025 camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01689 2025-11-04 cs.CL cs.AI cs.LG 83%

Open Character Training: Shaping the Persona of AI Assistants through Constitutional AI

Sharan Maiya, Henning Bartsch, Nathan Lambert, Evan Hubinger

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);prompting(abstract)

Comments 12 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.18253 2025-11-04 cs.CL 83%

From BERT to LLMs: Comparing and Understanding Chinese Classifier Prediction in Language Models

Ziqi Zhang, Jianfei Ma, Emmanuele Chersoni, Jieshun You, Zhaoxin Feng

机构 * Department of Language Science and Technology, The Hong Kong Polytechnic University(语言科学与技术系,香港理工大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00509 2025-11-04 cs.AI cs.CR 81%

Reimagining Safety Alignment with An Image

Yifan Xia, Guorui Chen, Wenqian Yu, Zhijiang Li, Philip Torr, Jindong Gu

机构 * School of Information Management, Wuhan University, Wuhan, China(武汉大学信息管理学院) Torr Vision Group, University of Oxford, Oxford, United Kingdom(牛津大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);RLHF(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00220 2025-11-04 cs.LG 79%

Iterative Foundation Model Fine-Tuning on Multiple Rewards

Pouya M. Ghari, Simone Sciabola, Ye Wang

机构 * Biogen(百健)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00814 2025-11-04 cs.CL 79%

Knowledge-augmented Pre-trained Language Models for Biomedical Relation Extraction

Mario Sänger, Ulf Leser

机构 * Humboldt-Universität zu Berlin(洪堡大学柏林分校) AstraZeneca(阿斯利康)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL

Journal ref BMC Bioinformatics 26, 240 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03724 2025-11-04 cs.CV cs.CL 79%

CrowdVLM-R1: Expanding R1 Ability to Vision Language Model for Crowd Counting using Fuzzy Group Relative Policy Reward

Zhiqiang Wang, Pengbin Feng, Yanbin Lin, Shuzhang Cai, Zongao Bian, Jinghua Yan, Xingquan Zhu

机构 * Florida Atlantic University(佛罗里达大学) University of Southern California(南加州大学) University of Texas at Dallas(德克萨斯大学达拉斯分校) Georgia Institute of Technology(佐治亚理工学院) University of Utah(犹他大学)

专题命中 指令微调 :language model(title);SFT(abstract);分类 cs.CL

Comments 10 pages, 6 figures and 4 tables

Journal ref 2025 IEEE International Conference on Big Data (IEEE BigData 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00070 2025-11-04 cs.LG cs.AI 79%

Benchmarking Generative AI Against Bayesian Optimization for Constrained Multi-Objective Inverse Design

Muhammad Bilal Awan, Abdul Razzaq, Abdul Shahid

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 17 pages, 2 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01454 2025-11-04 cs.CL cs.DL 77%

"Don't Teach Minerva": Guiding LLMs Through Complex Syntax for Faithful Latin Translation with RAG

Sergio Torres Aguilar

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.00985 2025-11-04 cs.CL 77%

Discourse Heuristics For Paradoxically Moral Self-Correction

Guangliang Liu, Zimo Qi, Xitong Zhang, Kristen Marie Johnson

机构 * Michigan State University(密歇根州立大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01463 2025-11-04 cs.CV cs.AI cs.GR 70%

HMVLM: Human Motion-Vision-Lanuage Model via MoE LoRA

Lei Hu, Yongjing Ye, Shihong Xia

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :language model(abstract);foundation model(abstract);分类 cs.AI

Comments 10 pages, 5figures. The Thirty-Ninth Annual Conference on Neural Information Processing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01104 2025-11-04 cs.SE cs.CL 70%

HarnessLLM: Automatic Testing Harness Generation via Reinforcement Learning

Yujian Liu, Jiabao Ji, Yang Zhang, Wenbo Guo, Tommi Jaakkola, Shiyu Chang

机构 * UC Santa Barbara(加州大学圣巴巴拉分校) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) MIT CSAIL(麻省理工CSAIL)

专题命中 指令微调 :LLM(abstract);SFT(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00556 2025-11-04 cs.CL 70%

Friend or Foe: How LLMs' Safety Mind Gets Fooled by Intent Shift Attack

Peng Ding, Jun Kuang, Wen Sun, Zongyu Wang, Xuezhi Cao, Xunliang Cai, Jiajun Chen, Shujian Huang

机构 * National Key Laboratory for Novel Software Technology, Nanjing University(南京大学新型软件技术国家重点实验室) Meituan Inc.(美团公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Preprint, 14 pages, 5 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01794 2025-11-04 cs.LG cs.AI cs.CL 67%

Random Initialization of Gated Sparse Adapters

Vi Retault, Yohaï-Eliel Berreby

机构 * GIGL Department, Polytechnique Montréal, Montréal, QC, Canada(波士顿理工大学蒙特利尔分校GIGL部门) Department of Physiology, McGill University, Montréal, QC, Canada(麦吉尔大学生理学系) Mila - Quebec AI Institute(魁北克AI研究所)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages (8 main), 6 figures (4 main). Accepted by NewInML workshop @ ICML 2025 on June 27, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00091 2025-11-04 cs.CV cs.RO 67%

Self-Improving Vision-Language-Action Models with Data Generation via Residual RL

Wenli Xiao, Haotian Lin, Andy Peng, Haoru Xue, Tairan He, Yuqi Xie, Fengyuan Hu, Jimmy Wu, Zhengyi Luo, Linxi "Jim" Fan, Guanya Shi, Yuke Zhu

机构 * NVIDIA(NVIDIA公司) CMU(卡内基梅隆大学) UC Berkeley(加州大学伯克利分校) UT Austin(德克萨斯大学奥斯汀分校)

专题命中 指令微调 :post-training(abstract);SFT(abstract)

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16813 2025-11-04 cs.CL cs.AI 62%

Incivility and Rigidity: Evaluating the Risks of Fine-Tuning LLMs for Political Argumentation

Svetlana Churina, Kokil Jaidka

专题命中 指令微调 :prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01449 2025-11-04 cs.CV cs.AI 57%

Privacy Preserving Ordinal-Meta Learning with VLMs for Fine-Grained Fruit Quality Prediction

Riddhi Jain, Manasi Patwardhan, Aayush Mishra, Parijat Deshpande, Beena Rai

机构 * TCS-Research Pune, India(TCS-研究 Pune,印度)

专题命中 指令微调 :language model(abstract);分类 cs.AI

Comments 9 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01645 2025-11-04 cs.CV 50%

Enhancing Diffusion-based Restoration Models via Difficulty-Adaptive Reinforcement Learning with IQA Reward

Xiaogang Xu, Ruihang Chu, Jian Wang, Kun Zhou, Wenjie Shu, Harry Yang, Ser-Nam Lim, Hao Chen, Liang Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) Snap Research Shenzhen University(深圳大学) HKUST(香港科技大学) University of Central Florida(佛罗里达大学) UC Davis(加州大学戴维斯分校) Sun Yat-Sen University(孙中山大学)

专题命中 指令微调 :SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏