arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-07-28 至 2025-07-28 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 4 篇

2507.19156 2025-07-28 cs.CL cs.AI cs.CY cs.HC 90%

An Empirical Investigation of Gender Stereotype Representation in Large Language Models: The Italian Case

Gioele Giachino, Marco Rondina, Antonio Vetrò, Riccardo Coppola, Juan Carlos De Martin

机构 * Politecnico di Torino(都灵理工大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 16 pages, European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2025) - 5th Workshop on Bias and Fairness in AI (BIAS25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03032 2025-07-28 cs.LG cs.CL 84%

Analyze Feature Flow to Enhance Interpretation and Steering in Language Models

Daniil Laptev, Nikita Balagansky, Yaroslav Aksenov, Daniil Gavrilov

机构 * mipt(莫斯科物理技术学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18631 2025-07-28 cs.CR 82%

Layer-Aware Representation Filtering: Purifying Finetuning Data to Preserve LLM Safety Alignment

Hao Li, Lijun Li, Zhenghao Lu, Xianyi Wei, Rui Li, Jing Shao, Lei Sha

专题命中 知识编辑与模型理解 :LLM(title,abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19262 2025-07-28 cs.CV 67%

OVFact: Measuring and Improving Open-Vocabulary Factuality for Long Caption Models

Monika Wysoczańska, Shyamal Buch, Anurag Arnab, Cordelia Schmid

机构 * Google DeepMind(谷歌DeepMind) Warsaw University of Technology(华沙技术大学)

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏