arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-06 至 2026-02-06 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 8 篇

2505.12300 2026-02-06 cs.CL 89%

HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models

HBO:用于微调大语言模型的分层平衡优化

Weixuan Wang, Minghao Wu, Barry Haddow, Alexandra Birch

机构 * School of Informatics, University of Edinburgh(爱丁堡大学信息学院) Tongyi Lab, Alibaba Group(阿里集团通义实验室)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 HBO通过分层平衡优化方法,在LLM微调中解决数据不平衡和异质性问题,提升跨数据集和单数据集的训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05694 2026-02-06 cs.CL 88%

Consensus-Aligned Neuron Efficient Fine-Tuning Large Language Models for Multi-Domain Machine Translation

共识对齐的神经高效细调大型语言模型用于多领域机器翻译

Shuting Jiang, Ran Song, Yuxin Huang, Yan Xiang, Yantuan Xian, Shengxiang Gao, Zhengtao Yu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出一种神经高效微调框架,通过识别和更新共识对齐的神经元,提升大型语言模型在多领域机器翻译中的性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05485 2026-02-06 cs.CY 88%

Fine-Tuning Large Language Models for Automatic Detection of Sexually Explicit Content in Spanish-Language Song Lyrics

对西班牙语歌曲歌词中色情内容进行自动检测的大型语言模型微调

Dolores Zamacola Sánchez de Lamadrid, Eduardo C. Garrido-Merchán

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文通过微调GPT模型,实现了对西班牙语歌曲歌词中色情内容的自动检测,并提出音乐内容评级的政策建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05327 2026-02-06 cs.AI 77%

ProAct: Agentic Lookahead in Interactive Environments

ProAct:交互环境中的代理前瞻性

Yangbin Yu, Mingyu Yang, Junyou Li, Yiming Gao, Feiyu Liu, Yijun Yang, Zichuan Lin, Jiafei Lyu, Yicheng Liu, Zhicong Lu, Deheng Ye, Jie Jiang

机构 * Tencent Hunyuan(腾讯文言)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ProAct通过双阶段训练范式提升交互环境中的前瞻性推理能力,结合GLAD和MC-Critic实现更稳定的策略优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05532 2026-02-06 cs.AI cs.LG 73%

Split Personality Training: Revealing Latent Knowledge Through Alternate Personalities

分裂人格训练:通过交替人格揭示潜在知识

Florian Dietz, William Wale, Oscar Gilg, Robert McCarthy, Felix Michalak, Gustavo Ewbank Rodrigues Danon, Miguelito de Guzman, Dietrich Klakow

机构 * University of Bergen, Bergen, Norway(卑尔根大学) Independent Researcher, London, UK(独立研究者) University College London, London, UK(伦敦大学学院) Independent Researcher, Berlin, Germany(独立研究者) Independent Researcher(独立研究者) Head of Research(研发负责人)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过分裂人格训练方法,揭示大型语言模型中隐藏的潜在知识,提升对模型行为的审计能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05780 2026-02-06 cs.SE cs.AI 57%

Automated Customization of LLMs for Enterprise Code Repositories Using Semantic Scopes

基于语义范围的LLM企业代码仓库自动化定制

Ulrich Finkler, Irene Manotas, Wei Zhang, Geert Janssen, Octavian Popescu, Shyam Ramji

机构 * IBM Research Yorktown Heights New York, USA(IBM研究院扬斯敦高地新 York 美国)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

AI总结 本文提出基于语义范围的LLM企业代码仓库自动化定制方法,通过RAG和FT策略提升代码生成精度,提高开发者生产力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05567 2026-02-06 cs.LG 57%

MAGPrompt: Message-Adaptive Graph Prompt Tuning for Graph Neural Networks

MAGPrompt: 用于图神经网络的消息适应图提示调优

Long D. Nguyen, Binh P. Nguyen

机构 * School of Mathematics and Statistics(数学与统计学系)

专题命中 指令微调 :prompting(abstract);分类 cs.LG

AI总结 MAGPrompt通过在消息传递步骤中注入可学习提示,实现对图神经网络的高效适应,在少样本设置中优于现有方法,并在全样本设置中与微调性能相当。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02258 2026-02-06 cs.LG 57%

Alignment-Aware Model Adaptation via Feedback-Guided Optimization

通过反馈引导优化实现对齐感知的模型适应

Gaurav Bhatt, Aditya Chinchure, Jiawei Zhou, Leonid Sigal

机构 * Department of Computer Science, University of British Columbia, Location, Canada(不列颠哥伦比亚大学计算机科学系) Vector Institute of AI, Toronto, Canada(人工智能向量研究所) Stony Brook University, New York, USA(石溪大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 本文提出了一种通过反馈引导优化实现对齐感知的模型适应框架,通过自适应门控机制平衡监督与对齐梯度,减少有害输出并提升模型对齐性。

详情

展开后加载摘要…

URL PDF HTML 收藏