arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-15 至 2026-01-15 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 后训练与偏好优化 4 篇

2601.09555 2026-01-15 cs.CL cs.AI 92%

Benchmarking Post-Training Quantization of Large Language Models under Microscaling Floating Point Formats

在微缩浮点格式下对大语言模型进行后训练量化评估

Manyi Zhang, Ji-Fu Li, Zhongao Sun, Haoli Bai, Hui-Ling Zhen, Zhenhua Dong, Xianzhi Yu

机构 * Huawei Technologies(华为技术)

专题命中 后训练与偏好优化 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);LLM(abstract)

AI总结 本文研究了在微缩浮点格式下大语言模型后训练量化的效果,发现MXFP8性能接近无损,而MXFP4存在显著精度损失,且格式兼容性对PTQ效果影响显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08842 2026-01-15 cs.CL cs.AI 88%

Resisting Correction: How RLHF Makes Language Models Ignore External Safety Signals in Natural Conversation

对抗修正:RLHF如何使语言模型在自然对话中忽视外部安全信号

Felipe Biava Cataneo

机构 * Felipe Biava Cataneo(独立研究者)

专题命中 后训练与偏好优化 :language model(title,abstract);RLHF(title,abstract);分类 cs.CL、cs.AI

AI总结 RLHF使语言模型在自然对话中忽视外部安全信号,影响安全纠正的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08884 2026-01-15 cs.SE cs.AI cs.DC 87%

Bridging the Gap: Empowering Small Models in Reliable OpenACC-based Parallelization via GEPA-Optimized Prompting

弥合差距:通过GEPA优化提示赋能小型模型在可靠OpenACC并行化中的应用

Samyak Jhaveri, Cristina V. Lopes

机构 * School of Information and Computer Science(信息与计算机科学学院) University of California, Irvine(加州大学伊文斯顿分校)

专题命中 后训练与偏好优化 :prompting(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 通过GEPA优化提示提升小型模型在OpenACC并行化中的性能与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17217 2026-01-15 cs.CL cs.AI cs.CY 79%

Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs

通过促进大语言模型的探索性思维来缓解性别偏见

Kangda Wei, Hasnat Md Abdullah, Ruihong Huang

专题命中 后训练与偏好优化 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

AI总结 通过生成性别中性故事对并利用直接偏好优化,该研究旨在减少大语言模型中的性别偏见,同时保持模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏