arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-05 至 2026-01-05 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 16 篇

2601.00736 2026-01-05 cs.CL cs.AI 91%

Exploring the Performance of Large Language Models on Subjective Span Identification Tasks

探索大型语言模型在主观跨度识别任务中的性能

Alphaeus Dmonte, Roland Oruche, Tharindu Ranasinghe, Marcos Zampieri, Prasad Calyam

机构 * George Mason University(乔治·马歇尔大学) University of Missouri(密苏里大学) Lancaster University(兰卡斯特大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);instruction tuning(abstract)

AI总结 本文探讨了大型语言模型在情感分析、攻击性语言识别和声明验证等任务中进行主观跨度识别的性能,评估了多种LLM策略的效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00254 2026-01-05 cs.SE cs.AI 90%

An Empirical Evaluation of LLM-Based Approaches for Code Vulnerability Detection: RAG, SFT, and Dual-Agent Systems

基于大型语言模型的代码漏洞检测方法实证评估:RAG、SFT和双智能体系统

Md Hasan Saju, Maher Muhtadi, Akramul Azim

机构 * Department of Electrical, Computer, and Software Engineering(电气、计算机与软件工程系) Ontario Tech University(安大略技术大学)

专题命中 指令微调 :LLM(title,abstract);SFT(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过实证评估,比较了RAG、SFT和双智能体系统在代码漏洞检测中的有效性,发现RAG在准确率和F1分数上表现最佳,SFT和双智能体系统也展示了良好的性能,证明了领域专业知识对LLM在实际漏洞检测中的重要性。

Journal ref https://conf.researchr.org/home/cascon-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22905 2026-01-05 cs.CV 88%

JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and Generation

JavisGPT:一种用于声音-视频理解和生成的统一多模态大语言模型

Kai Liu, Jungang Li, Yuchong Sun, Shengqiong Wu, Jianzhang Gao, Daoan Zhang, Wei Zhang, Sheng Jin, Sicheng Yu, Geng Zhan, Jiayi Ji, Fan Zhou, Liang Zheng, Shuicheng Yan, Hao Fei, Tat-Seng Chua

机构 * ZJU(浙江大学) NUS(国立新加坡大学) HKUST(GZ)(香港科技大学(广州)) RUC(中国人民大学) HZCU(杭州电子科技大学) NTU(国立台湾大学) SMU(新加坡国立大学) USYD(澳大利亚悉尼大学) ANU(澳大利亚国立大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

AI总结 JavisGPT是一种统一多模态大语言模型,通过三阶段训练流程在声音-视频理解和生成任务中表现出色,尤其在复杂和时间同步场景中表现更优。

Comments Accepted by NeurIPS as a Spotlight paper. Code: https://github.com/JavisVerse/JavisGPT

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00777 2026-01-05 cs.SD cs.CV 88%

Investigating the Viability of Employing Multi-modal Large Language Models in the Context of Audio Deepfake Detection

探讨在音频深度伪造检测中使用多模态大语言模型的可行性

Akanksha Chuchra, Shukesh Reddy, Sudeepta Mishra, Abhijit Das, Abhinav Dhall

机构 * Indian Institute of Technology, Ropar, India(印度理工学院罗帕尔分校) Machine Intelligence Group, Birla Institute of Technology and Science, Pilani, Hyderabad Campus, India(比拉理工科学院帕利尼 Hyderabad 分校机器智能小组) Monash University, Melbourne, Australia(墨尔本大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文探讨了多模态大语言模型在音频深度伪造检测中的可行性,通过结合音频输入与多提示方法,展示了模型在域内数据上的良好表现及潜在应用价值。

Comments Accepted at IJCB 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04862 2026-01-05 cs.CL 86%

EXAONE 3.5: Series of Large Language Models for Real-world Use Cases

EXAONE 3.5:面向实际应用场景的大型语言模型系列

Soyoung An, Kyunghoon Bae, Eunbi Choi, Kibong Choi, Stanley Jungkyu Choi, Seokhee Hong, Junwon Hwang, Hyojin Jeon, Gerrard Jeongwon Jo, Hyunjik Jo, Jiyeon Jung, Yountae Jung, Hyosang Kim, Joonkee Kim, Seonghwan Kim, Soyeon Kim, Sunkyoung Kim, Yireun Kim, Yongil Kim, Youchul Kim, Edward Hwayoung Lee, Haeju Lee, Honglak Lee, Jinsik Lee, Kyungmin Lee, Woohyung Lim, Sangha Park, Sooyoun Park, Yongmin Park, Sihoon Yang, Heuiyeen Yeen, Hyeongu Yun

机构 * LG AI Research(LG人工智能研究)

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL

AI总结 EXAONE 3.5系列模型通过指令微调在现实场景中实现卓越的指令遵循能力,同时在长上下文理解和通用基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03541 2026-01-05 cs.CL cs.AI 84%

EXAONE 3.0 7.8B Instruction Tuned Language Model

EXAONE 3.0 7.8B 指令微调语言模型

Soyoung An, Kyunghoon Bae, Eunbi Choi, Stanley Jungkyu Choi, Yemuk Choi, Seokhee Hong, Yeonjung Hong, Junwon Hwang, Hyojin Jeon, Gerrard Jeongwon Jo, Hyunjik Jo, Jiyeon Jung, Yountae Jung, Euisoon Kim, Hyosang Kim, Joonkee Kim, Seonghwan Kim, Soyeon Kim, Sunkyoung Kim, Yireun Kim, Youchul Kim, Edward Hwayoung Lee, Haeju Lee, Honglak Lee, Jinsik Lee, Kyungmin Lee, Moontae Lee, Seungjun Lee, Woohyung Lim, Sangha Park, Sooyoun Park, Yongmin Park, Boseong Seo, Sihoon Yang, Heuiyeen Yeen, Kyungjae Yoo, Hyeongu Yun

机构 * LG AI Research(LG人工智能研究)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 EXAONE 3.0 7.8B 指令微调语言模型在韩语和通用任务中表现优异,通过开源促进专家AI的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00088 2026-01-05 cs.LG 83%

Dynamic Bayesian Optimization Framework for Instruction Tuning in Partial Differential Equation Discovery

用于偏微分方程发现的动态贝叶斯优化框架用于指令微调

Junqi Qu, Yan Zhang, Shangqian Gao, Shibo Li

机构 * Department of Computer Science, Florida State University(佛罗里达州立大学计算机科学系)

专题命中 指令微调 :instruction tuning(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 NeuroSymBO通过动态贝叶斯优化框架提升偏微分方程发现任务中的指令微调效果,实现更优的解决方案和更高的恢复率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00566 2026-01-05 cs.CR 82%

Low Rank Comes with Low Security: Gradient Assembly Poisoning Attacks against Distributed LoRA-based LLM Systems

低秩带来低安全:针对分布式LoRA-based LLM系统的梯度装配中毒攻击

Yueyan Dong, Minghui Xu, Qin Hu, Yinhao Xiao, Qi Luo, Yechao Zhang, Yue Zhang, Xiuzhen Cheng

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract)

AI总结 针对分布式LoRA-based LLM系统,提出GAP攻击,通过构造无害的A和B矩阵乘积产生恶意更新,导致模型输出降级和错误增加。

Comments 8 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00446 2026-01-05 cs.LG 79%

A Comparative Study of Adaptation Strategies for Time Series Foundation Models in Anomaly Detection

时间序列基础模型在异常检测中的适应策略比较研究

Miseon Park, Kijung Yoon

机构 * Department of Electronic Engineering, Hanyang University, Seoul, Korea(电子工程系,翰阳大学,首尔,韩国) Department of Artificial Intelligence, Hanyang University, Seoul, Korea(人工智能系,翰阳大学,首尔,韩国)

专题命中 指令微调 :foundation model(title,abstract);分类 cs.LG

AI总结 本文研究了时间序列基础模型在异常检测中的适应策略,发现其在多种基准上表现优异,尤其在类别不平衡情况下,PEFT方法能有效提升性能并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00229 2026-01-05 cs.LG 79%

Robust Graph Fine-Tuning with Adversarial Graph Prompting

鲁棒图微调与对抗图提示

Ziyan Zhang, Bo Jiang, Jin Tang

机构 * School of Computer Science and Technology, Anhui University(计算机科学与技术学院,安徽大学) State Key Laboratory of Opto-Electronic Information Acquisition and Protection Technology(光电信息采集与防护技术国家重点实验室)

专题命中 指令微调 :prompting(title,abstract);分类 cs.LG

AI总结 本文提出对抗图提示(AGP)方法,通过整合对抗学习提升图神经网络在对抗噪声下的鲁棒性,并在多个基准任务上验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00583 2026-01-05 cs.LG cs.AI cs.NI 79%

HFedMoE: Resource-aware Heterogeneous Federated Learning with Mixture-of-Experts

HFedMoE: 带有专家混合的资源感知异构联邦学习

Zihan Fang, Zheng Lin, Senkang Hu, Yanan Ma, Yihang Tao, Yiqin Deng, Xianhao Chen, Yuguang Fang

机构 * Hong Kong JC STEM Lab of Smart City and Department of Computer Science, City University of Hong Kong(香港JC STEM实验室及城市大学计算机科学系)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 HFedMoE通过定制专家子集和稀疏性感知聚合策略,实现高效异构联邦学习微调。

Comments 14 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00372 2026-01-05 cs.CR 78%

LLM-Powered Analysis of IoT User Reviews: Tracking and Ranking Security and Privacy Concerns

基于大语言模型的物联网用户评论分析:跟踪和排序安全与隐私问题

Taufiq Islam Protick, Sai Teja Peddinti, Nina Taft, Anupam Das

专题命中 指令微调 :LLM(title);prompting(abstract)

AI总结 本研究利用大语言模型分析物联网用户评论,识别和排序安全与隐私问题,发现安全摄像头的高关注度及持续存在的隐私问题,为开发者改进用户信任提供洞察。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00146 2026-01-05 astro-ph.IM cs.LG 70%

Combining datasets with different ground truths using Low-Rank Adaptation to generalize image-based CNN models for photometric redshift prediction

利用低秩适应结合不同地面真实数据集来泛化基于图像的CNN模型以预测光度红移

Vikram Seenivasan, Srinath Saikrishnan, Andrew Lizarraga, Jonathan Soriano, Bernie Boscoe, Tuan Do

机构 * UCLA(加州大学洛杉矶分校)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文利用LoRA技术结合不同红移数据集,提升CNN模型在光度红移预测中的泛化能力与准确性。

Comments 11 pages, 7 figures, 3 tables, Accepted to the Conference on Neural Information Processing Systems (NeurIPS), Machine Learning and the Physical Sciences (ML4PS) Workshop 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03402 2026-01-05 cs.CL 70%

Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates

Dual LoRA: 通过幅度和方向更新增强LoRA

Yixing Xu, Chao Li, Xuanwu Yin, Spandan Tiwari, Dong Li, Ashish Sirasao, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Dual LoRA通过引入幅度和方向更新机制,改进LoRA在参数高效微调中的性能,实验表明其在多个NLP任务上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24652 2026-01-05 cs.CL cs.IR 70%

Optimizing Retrieval for RAG via Reinforcement Learning

通过强化学习优化RAG的检索

Jiawei Zhou, Lei Chen

专题命中 指令微调 :LLM(abstract);SFT(abstract);分类 cs.CL

AI总结 通过强化学习优化RAG检索,提升检索性能并适应多样化环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11167 2026-01-05 cs.CL 70%

Cultural Palette: Pluralising Culture Alignment via Multi-agent Palette

文化调色板:通过多智能体调色板实现文化对齐的多元化

Jiahao Yuan, Zixiang Di, Shangzixin Zhao, Zhiqing Cui, Hanqing Wang, Guisong Yang, Usman Naseem

机构 * ECNU(华东师范大学) USST(上海理工大学) BNU(北京师范大学) HKUST–GZ(香港理工大学-广州)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 Cultural Palette通过多智能体框架实现文化对齐的多元化,利用文化地理和颜色混合机制提升跨文化响应的适应性与准确性。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏