arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-09 至 2026-01-09 共收录 4 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 4 篇

2601.04711 2026-01-09 cs.CL cs.AI 79%

DSC2025 -- ViHallu Challenge: Detecting Hallucination in Vietnamese LLMs

DSC2025 -- ViHallu挑战:检测越南语大语言模型中的幻觉

Anh Thi-Hoang Nguyen, Khanh Quoc Tran, Tin Van Huynh, Phuoc Tan-Hoang Nguyen, Cam Tan Nguyen, Kiet Van Nguyen

机构 * Faculty of Information Science and Engineering, University of Information Technology(信息科学与工程学院,信息技术大学) University of Information Technology, Ho Chi Minh City, Vietnam(信息技术大学,胡志明市,越南) Vietnam National University, Ho Chi Minh City, Vietnam(越南国家大学,胡志明市,越南)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 DSC2025 ViHallu挑战通过建立首个越南语LLM幻觉检测基准,探索多种检测方法,验证了结构化提示和集成策略在提升检测性能方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03957 2026-01-09 cs.CR cs.IR cs.LG 77%

Practical Poisoning Attacks against Retrieval-Augmented Generation

针对检索增强生成的实用污染攻击

Baolei Zhang, Yuxi Chen, Zhuqing Liu, Lihai Nie, Tong Li, Zheli Liu, Minghong Fang

机构 * CS\&CCS, Nankai University(CS与CCS,南开大学) Independent Researcher(独立研究者) University of North Texas(北德克萨斯大学) University of Louisville(路易斯维尔大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 CorruptRAG是一种针对RAG系统的实用污染攻击,通过注入单条污染文本实现更高的攻击成功率和隐蔽性。

Comments To appear in ACM SACMAT 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03707 2026-01-09 cs.LG cs.AI cs.CL stat.ML 75%

What Should Embeddings Embed? Autoregressive Models Represent Latent Generating Distributions

嵌入应该嵌入什么?自回归模型表示潜在生成分布

Liyi Zhang, Michael Y. Li, R. Thomas McCoy, Theodore R. Sumers, Jian-Qiao Zhu, Thomas L. Griffiths

机构 * Department of Computer Science(计算机科学系) Princeton University(普林斯顿大学) Stanford University(斯坦福大学) Department of Linguistics and Wu Tsai Institute(语言学系和吴泰教授研究所) Yale University(耶鲁大学) Anthropic(Anthropic公司) Departments of Psychology and Computer Science(心理学系和计算机科学系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨了自回归模型中嵌入应代表的潜在生成分布,并通过实验证明了其在不同场景下的有效性。

Comments 28 pages, 11 figures

Journal ref Transactions on Machine Learning Research. 2025. https://openreview.net/forum?id=YyMACp98Kz

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04480 2026-01-09 cs.LG 57%

When Models Manipulate Manifolds: The Geometry of a Counting Task

当模型操纵流形:计数任务的几何学

Wes Gurnee, Emmanuel Ameisen, Isaac Kauvar, Julius Tarng, Adam Pearce, Chris Olah, Joshua Batson

机构 * Anthropic

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 研究揭示了语言模型通过几何变换实现文本换行的机制,展示了早期层的感官处理和注意力算法的复杂性。

详情

展开后加载摘要…

URL PDF HTML 收藏