arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-23 至 2026-01-23 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11 篇

2601.07903 2026-01-23 cs.LG cs.AI 91%

Enhancing Large Language Models for Time-Series Forecasting via Vector-Injected In-Context Learning

通过向量注入上下文学习增强大型语言模型用于时间序列预测

Jianqi Zhang, Jingyao Wang, Wenwen Qiang, Fanjiang Xu, Changwen Zheng

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of the Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

AI总结 本文提出LVICL方法,通过向量注入上下文学习提升LLM在时间序列预测中的性能,无需微调参数以减少计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15879 2026-01-23 cs.SE cs.CL 87%

Evaluating and Achieving Controllable Code Completion in Code LLM

评估和实现可控的代码补全在代码LLM中

Jiajun Zhang, Zeyu Cui, Lei Zhang, Jian Yang, Jiaxi Yang, Qiang Liu, Zilei Wang, Binyuan Hui, Liang Wang, Junyang Lin

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出可控代码补全基准C3-Bench,评估了40种LLM在代码补全中的指令遵循能力,开发数据合成管道并推出Qwen2.5-Coder-C3模型,实现代码补全性能的突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05867 2026-01-23 cs.CR cs.CL 87%

Can LLM Infer Risk Information From MCP Server System Logs?

LLM能否从MCP服务器系统日志中推断风险信息?

Jiayi Fu, Yuansen Zhang, Yinggui Wang

机构 * Southern University of Science and Technology(南方科技大学)

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 本文提出首个评估LLM从MCP服务器系统日志中识别安全风险的合成基准,通过训练不同模型展示强化学习在提升LLM安全性能中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11298 2026-01-23 cs.NI cs.AI cs.CL 81%

Integrating Language Models for Enhanced Network State Monitoring in DRL-Based SFC Provisioning

在基于深度强化学习的SFC配置中整合语言模型以增强网络状态监控

Parisa Fard Moshiri, Murat Arda Onsu, Poonam Lohan, Burak Kantarci, Emil Janulewicz

机构 * University of Ottawa(渥太华大学) Ciena(Ciena公司)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文提出将深度强化学习与BERT结合,以提升基于DRL的SFC配置中网络状态监控的效率和准确性。

Comments 6 pages, 5 figures, submitted to 30th IEEE International Symposium on Computers and Communications (ISCC) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11137 2026-01-23 cs.CR 75%

CoSPED: Consistent Soft Prompt Targeted Data Extraction and Defense

CoSPED:一致的软提示定向数据提取与防御

Zhuochen Yang, Kar Wai Fok, Vrizlynn L. L. Thing

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 CoSPED通过动态损失、加性损失等创新组件提升软提示调优一致性,实现高提取率并有效防御软提示攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07519 2026-01-23 cs.IR cs.CL 70%

GRITHopper: Decomposition-Free Multi-Hop Dense Retrieval

GRITHopper:无分解多跳密集检索

Justus-Jonas Erker, Nils Reimers, Iryna Gurevych

专题命中 指令微调 :language model(abstract);instruction tuning(abstract);分类 cs.CL

AI总结 GRITHopper-7B通过结合生成和表示指令微调,提出了一种无分解多跳密集检索模型,实现了在分布内和分布外基准上的最佳性能。

Comments Accepted at EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14490 2026-01-23 cs.CV cs.AI cs.CL cs.LG 67%

GutenOCR: A Grounded Vision-Language Front-End for Documents

GutenOCR:文档的 grounded 视觉-语言前端

Hunter Heidenreich, Ben Elliott, Olivia Dinica, Yosheb Getachew

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 GutenOCR 通过微调 Qwen2.5-VL 模型,实现了文档中的 grounded OCR 和检测,提升了 OCR 得分和文本检测召回率,但存在页面线性化和公式布局方面的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15390 2026-01-23 cs.LG 57%

FedUMM: A General Framework for Federated Learning with Unified Multimodal Models

FedUMM: 一种统一多模态模型的联邦学习通用框架

Zhaolong Su, Leheng Zhao, Xiaoying Wu, Ziyue Xu, Jindong Wang

机构 * NVIDIA

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 FedUMM提出了一种低通信成本的联邦学习框架,用于训练统一多模态模型,通过参数高效微调实现客户端和服务器的高效协作,提升了隐私保护下的多模态模型训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04369 2026-01-23 physics.soc-ph cs.CL 57%

Generalization to Political Beliefs from Fine-Tuning on Sports Team Preferences

从体育队偏好微调到政治信念的泛化

Owen Terry

专题命中 指令微调 :LLM(abstract);分类 cs.CL

AI总结 研究通过微调体育队偏好模型,发现其政治信念泛化与预期不符,需进一步探索微调机制对模型行为的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03892 2026-01-23 cs.SD cs.LG 57%

Lightweight and perceptually-guided voice conversion for electro-laryngeal speech

轻量级且感知引导的语音转换用于电声式语音

Benedikt Mayrhofer, Franz Pernkopf, Philipp Aichinger, Martin Hagmüller

专题命中 指令微调 :pretraining(abstract);分类 cs.LG

AI总结 本文提出一种轻量级语音转换方法,通过结合自监督预训练与监督微调,提升电声式语音的自然度和可懂度,验证了轻量级架构在语音康复中的可行性。

Comments 5 pages, 5 figures. Paper accepted for ICASSP 2026. Audio samples available at https://spsc-tugraz.github.io/lw-elvc-icassp26/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15594 2026-01-23 cs.IR 50%

Blockchain-Based Spectrum Resource Securitization via Semi-Fungible Token-Lock

基于区块链的频谱资源证券化 via 半法币代币锁定

Zhixian Zhou, Bin Chen, Zhe Peng, Zhiming Liang, Ruijun Wu, Chen Sun, Shuo Wang

专题命中 指令微调 :SFT(abstract)

AI总结 本文提出半法币代币锁定机制,通过确定性状态转换减少链上开销,实现频谱资产的灵活证券化与流动性增强。

详情

展开后加载摘要…

URL PDF HTML 收藏