arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-12-23 至 2025-12-23 共收录 17 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 17 篇

2405.04994 2025-12-23 cs.SE 89%

SPVR: syntax-to-prompt vulnerability repair based on large language models

SPVR: 基于大语言模型的语法到提示漏洞修复

Ruoke Wang, Zongjie Li, Cuiyun Gao, Chaozheng Wang, Yang Xiao, Xuan Wang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 SPVR通过语法分析生成针对性提示,提升大语言模型修复漏洞的准确性。

Journal ref Automated Software Engineering 33 (2026) 38

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18878 2025-12-23 cs.CV cs.AI 88%

CrashChat: A Multimodal Large Language Model for Multitask Traffic Crash Video Analysis

CrashChat: 一种多模态大语言模型用于多任务交通事故视频分析

Kaidi Liang, Ke Li, Xianbiao Hu, Ruwen Qin

机构 * Stony Brook University(石溪大学) The Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 CrashChat是一种多模态大语言模型,用于多任务交通事故视频分析,通过任务解耦和分组策略提升事故识别、定位等任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08139 2025-12-23 cs.IT cs.LG math.IT 85%

SCA-LLM: Spectral-Attentive LLM-Based Wireless World Modeling for Agentic Communications

SCA-LLM:基于频谱-注意力的LLM无线世界建模用于智能通信

Ke He, Le He, Lisheng Fan, Xianfu Lei, Thang X. Vu, George K. Karagiannidis, Symeon Chatzinotas

机构 * Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(安全、可靠性与信任跨学科研究中心(SnT),卢森堡大学) School of Computer Science of Guangzhou University(广州大学计算机科学学院) School of Information Science and Technology, Institute of Mobile Communications, Southwest Jiaotong University(信息科学与技术学院,移动通信研究所,西南交通大学) Department of Electrical and Computer Engineering, Aristotle University of Thessaloniki(电气与计算机工程系,塞萨洛尼基阿瑞斯托大学) Cyber Security Systems and Applied AI Research Center, Lebanese American University (LAU)(网络安全与应用人工智能研究中心,黎巴嫩美国大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 SCA-LLM通过频谱-注意力适配器将信道状态信息与LLM结合,实现无线世界建模,提升预测性能和零样本泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11185 2025-12-23 cs.CR cs.AI 79%

Bleeding Pathways: Vanishing Discriminability in LLM Hidden States Fuels Jailbreak Attacks

出血路径:LLM隐藏状态中的判别能力消失加剧了 jailbreak 攻击

Yingjie Zhang, Tong Liu, Zhe Zhao, Guozhu Meng, Kai Chen

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Ant Group(蚂蚁集团)

专题命中 指令微调 :LLM(title,abstract);分类 cs.AI

AI总结 本研究提出DEEPALIGN框架,通过增强LLM隐藏状态的分离度,有效缓解jailbreak攻击,提升安全性和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18801 2025-12-23 quant-ph 78%

Foundation Model for Unified Characterization of Optical Quantum States

光量子态统一表征的基础模型

Xiaoting Gao, Yan Zhu, Feng-Xiao Sun, Ya-Dong Wu, Qiongyi He

专题命中 指令微调 :foundation model(title,abstract)

AI总结 本文提出了一种基础模型,用于统一表征光量子态的复杂性,通过预训练和微调,有效预测多种实验相关态的性质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19297 2025-12-23 cs.CR cs.AI 77%

Causal-Guided Detoxify Backdoor Attack of Open-Weight LoRA Models

因果引导的LoRA开放权重后门攻击

Linzhi Chen, Yang Sun, Hongru Wei, Yuqi Chen

机构 * Independent Researcher(独立研究者)

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.AI

AI总结 本研究提出CBA框架,通过因果引导和覆盖引导技术,实现对LoRA开放权重模型的高效隐蔽后门攻击,减少假触发率并提升鲁棒性。

Comments NDSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10713 2025-12-23 cs.SE cs.AI 77%

PACIFIC: a framework for generating benchmarks to check Precise Automatically Checked Instruction Following In Code

PACIFIC:用于检查精确自动指令遵循的代码基准生成框架

Itay Dreyfuss, Antonio Abu Nassar, Samuel Ackerman, Axel Ben David, Eitan Farchi, Rami Katan, Orna Raz, Marcel Zalmanovici

机构 * IBM Research(IBM研究)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 PACIFIC框架通过生成具有明确预期输出的基准,评估LLM在代码指令遵循和dry运行能力上的表现,提供了一种抗污染且可扩展的评估方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17953 2025-12-23 cs.CV cs.AI 70%

Seeing Beyond the Scene: Analyzing and Mitigating Background Bias in Action Recognition

超越场景:分析和缓解动作识别中的背景偏见

Ellie Zhou, Jihoon Chung, Olga Russakovsky

机构 * Westmont High School(韦斯蒙特高中) Princeton University(普林斯顿大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文分析了动作识别中背景偏见的问题,并提出缓解策略,通过输入分割和提示调优降低背景偏见,提升模型对人类动作的识别能力。

Comments Accepted to NeurIPS 2025 Workshops: SPACE in Vision, Language, and Embodied AI; and What Makes a Good Video: Next Practices in Video Generation and Evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03291 2025-12-23 cs.CL 70%

ADePT: Adaptive Decomposed Prompt Tuning for Parameter-Efficient Fine-tuning

ADePT: 适应性分解提示微调用于参数高效微调

Pengwei Tang, Xiaolin Hu, Yong Liu

机构 * Renmin University of China(中国人民大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 ADePT通过引入适应性分解提示微调方法,改进了参数高效微调的性能,实现了更优的适应能力和更高效的推理速度。

Comments Published at ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00911 2025-12-23 cs.GR 67%

G2rammar: Bilingual Grammar Modeling for Enhanced Text-attributed Graph Learning

G2rammar: 双语语法建模用于增强文本属性图学习

Heng Zheng, Haochen You, Zijun Liu, Zijian Zhang, Lubin Gan, Hao Zhang, Wenjun Huang, Jin Huang

专题命中 指令微调 :large language model(abstract);language model(abstract)

AI总结 G2rammar通过双语语法框架,为文本属性图提供结构和语义语法,提升语言模型对图结构的理解能力。

Comments This submission has been withdrawn by the authors due to a fundamental error in the methodology that affects the validity of the main results

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18263 2025-12-23 eess.AS cs.AI cs.CL cs.LG 67%

TICL+: A Case Study On Speech In-Context Learning for Children's Speech Recognition

TICL+: 一项关于儿童语音识别中上下文学习的案例研究

Haolong Zheng, Yekaterina Yegorova, Mark Hasegawa-Johnson

专题命中 指令微调 :foundation model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 TICL+通过结合语义和音学信息,提升儿童语音识别的准确性和鲁棒性。

Comments Published at IEEE ASRU 2025 Satellite Workshop-AI for Children's Speech and Language

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08971 2025-12-23 cs.CL 57%

Structured Language Generation Model: Loss Calibration and Formatted Decoding for Robust Structure Prediction and Knowledge Retrieval

结构语言生成模型:损失校准与格式解码以实现稳健的结构预测与知识检索

Minho Lee, Junghyun Min, Yerang Kim, Woochul Lee, Yeonsoo Lee

机构 * KT Gen AI Lab(KT生成人工智能实验室) Georgetown University(乔治城大学) Korea University(韩国大学) NC AI(NC人工智能)

专题命中 指令微调 :language model(abstract);分类 cs.CL

AI总结 SLGM通过损失校准和格式解码提升结构预测和知识检索性能,无需额外参数或数据集特定工程。

Comments 20 pages, 4 figures. FrontierIR at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18551 2025-12-23 cs.CL 57%

Neologism Learning as a Parameter-Efficient Alternative to Fine-Tuning for Model Steering

新词学习作为模型引导的参数高效替代方案

Sungjoon Park, Varun Ramamurthi, Owen Terry

专题命中 指令微调 :language model(abstract);分类 cs.CL

AI总结 本文提出通过新词学习实现模型引导,相比微调更高效,且在相同训练条件下表现更优,同时发现模型会自动生成新词。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18251 2025-12-23 cond-mat.mtrl-sci cs.LG physics.comp-ph 57%

CrystalFormer-CSP: Thinking Fast and Slow for Crystal Structure Prediction

CrystalFormer-CSP: 快速与缓慢思考的晶体结构预测

Zhendong Cao, Shigang Ou, Lei Wang

机构 * Institute of Physics, Chinese Academy of Sciences, Beijing, China(中国科学院物理研究所) School of Physics, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学物理学院)

专题命中 指令微调 :language model(abstract);分类 cs.LG

AI总结 CrystalFormer-CSP结合数据驱动和物理驱动方法,通过预训练生成模型和力场优化,高效预测稳定晶体结构,并通过强化微调提升准确性。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19133 2025-12-23 cs.RO cs.CV 50%

WorldRFT: Latent World Model Planning with Reinforcement Fine-Tuning for Autonomous Driving

WorldRFT: 通过强化微调的潜在世界模型进行自动驾驶的规划

Pengxuan Yang, Ben Lu, Zhongpu Xia, Chao Han, Yinfeng Gao, Teng Zhang, Kun Zhan, XianPeng Lang, Yupeng Zheng, Qichao Zhang

专题命中 指令微调 :foundation model(abstract)

AI总结 WorldRFT通过强化学习微调提升自动驾驶规划性能,实现安全性和效率的双重优化。

Comments AAAI 2026, first version

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17436 2025-12-23 cs.CV 50%

Xiaomi MiMo-VL-Miloco Technical Report

小米 MiMo-VL-Miloco 技术报告

Jiaze Li, Jingyang Chen, Yuxun Qu, Shijie Xu, Zhenru Lin, Junyou Zhu, Boshen Xu, Wenhui Tan, Pei Fu, Jianzhong Ju, Zhenbo Luo, Jian Luan

机构 * Xiaomi(小米)

专题命中 指令微调 :language model(abstract)

AI总结 小米提出 MiMo-VL-Miloco 模型,专为家庭场景设计,通过两阶段训练提升多模态推理与家庭场景理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17930 2025-12-23 q-bio.OT cs.CV eess.IV q-bio.QM 50%

CytoDINO: Risk-Aware and Biologically-Informed Adaptation of DINOv3 for Bone Marrow Cytomorphology

CytoDINO: 风险感知且具有生物信息学依据的DINOv3在骨髓细胞形态学中的适应

Aziz Muminov, Anne Pham

机构 * Department of Computer Science and Mathematics, Dickinson College(计算机科学与数学系,迪克森学院)

专题命中 指令微调 :foundation model(abstract)

AI总结 CytoDINO通过LoRA微调DINOv3,在骨髓细胞形态学中实现高精度分类,利用生物信息学方法降低临床误诊风险,展示消费级硬件在医疗应用中的可行性。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏