arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-01-08 至 2026-01-08 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 9 篇

2601.03295 2026-01-08 q-bio.GN cs.LG 88%

MetagenBERT: a Transformer-based Architecture using Foundational genomic Large Language Models for novel Metagenome Representation

MetagenBERT: 一种基于Transformer的架构,利用基础基因大语言模型进行新颖的宏基因组表示

Gaspar Roy, Eugeni Belda, Baptiste Hennecart, Yann Chevaleyre, Edi Prifti, Jean-Daniel Zucker

机构 * IRD, Sorbonne University, UMMISCO(IRD、索邦大学、UMMISCO) Sorbonne University, INSERM, Nutriomics(索邦大学、国家卫生研究院、Nutriomics) LAMSADE, Dauphine University, PSL Research University(LAMSADE、达菲大学、PSL研究大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(title);foundation model(abstract);分类 cs.LG

AI总结 MetagenBERT通过端到端的DNA序列嵌入和聚类策略,无需注释即可实现宏基因组的高效表示,展示了在疾病预测中的优越性能和跨队列的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03671 2026-01-08 cs.CL cs.LG 84%

NeuronScope: A Multi-Agent Framework for Explaining Polysemantic Neurons in Language Models

NeuronScope:一种用于解释语言模型中多义神经元的多智能体框架

Weiqi Liu, Yongliang Miao, Haiyan Zhao, Yanguang Liu, Mengnan Du

机构 * Wuhan University(武汉大学) Hong Kong Baptist University(香港 Baptist大学) New Jersey Institute of Technology(新泽西理工学院) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 NeuronScope通过多智能体框架迭代优化神经元解释,揭示语言模型中隐藏的多义性并提升解释的激活相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03300 2026-01-08 cs.CR cs.LG 83%

TRYLOCK: Defense-in-Depth Against LLM Jailbreaks via Layered Preference and Representation Engineering

TRYLOCK:通过分层偏好和表征工程实现对LLM劫持的纵深防御

Scott Thornton

机构 * AI/ML Security Researcher(人工智能与机器学习安全研究员)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 TRYLOCK通过分层偏好和表征工程实现对LLM劫持的纵深防御,结合DPO、RepE、自适应侧车和输入规范化,有效降低攻击成功率并提升安全性与易用性的平衡。

Comments 14 pages, 4 figures. Code and datasets at https://github.com/scthornton/trylock

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03798 2026-01-08 cs.CL cs.AI 81%

Where meaning lives: Layer-wise accessibility of psycholinguistic features in encoder and decoder language models

意义栖息之处:编码器和解码器语言模型中心理语言学特征的分层可访问性

Taisiia Tikhomirova, Dirk U. Wulff

机构 * Max Planck Institute for Human Development(马克斯·普朗克人类发展研究所) Technische Universität Berlin(技术大学柏林) University of Basel(巴塞尔大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究揭示了变换器模型中心理语言学特征的分层可访问性,发现意义的定位依赖于方法和架构,并展示了词汇属性与经验性情感维度的深度差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03908 2026-01-08 cs.CL 70%

Decide Then Retrieve: A Training-Free Framework with Uncertainty-Guided Triggering and Dual-Path Retrieval

决定后再检索:一种无训练框架,结合不确定性引导触发和双路径检索

Wang Chen, Guanqiang Qi, Weikang Li, Yang Li, Deguo Xia, Jizhou Huang

机构 * Baidu Inc(百度公司) The University of Hong Kong(香港大学) Peking University(北京大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 DTR通过不确定性引导触发和双路径检索,提升问答性能并减少冗余检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03657 2026-01-08 cs.LG cs.AI 62%

In Search of Grandmother Cells: Tracing Interpretable Neurons in Tabular Representations

寻找祖母细胞:在表格表示中追踪可解释的神经元

Ricardo Knauer, Erik Rodner

机构 * KI-Werkstatt University of Applied Sciences Berlin(KI-Werkstatt应用科学大学柏林)

专题命中 知识编辑与模型理解 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出两种信息论度量,用于量化神经元对单一概念的显著性和选择性,并在表格基础模型TabPFN中发现部分神经元对高层概念具有统计显著的显著性。

Comments EurIPS 2025 Workshop on AI for Tabular Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03329 2026-01-08 cs.LG cs.AI 62%

Attention mechanisms in neural networks

神经网络中的注意机制

Hasi Hays

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.AI、cs.LG

AI总结 本文系统阐述了神经网络中注意机制的理论基础、计算特性及应用,涵盖自然语言处理、计算机视觉和多模态学习等多个领域,分析了其可解释性及当前存在的限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03305 2026-01-08 cs.CV cs.AI cs.CY 57%

Mass Concept Erasure in Diffusion Models with Concept Hierarchy

扩散模型中的概念擦除与概念层次

Jiahang Tu, Ye Li, Yiming Wu, Hanbin Zhao, Chao Zhang, Hui Qian

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.AI

AI总结 本文提出了一种基于概念层次的扩散模型擦除方法,通过群体擦除和超类型保留低秩适应技术,提高擦除效率并减少生成质量退化。

Comments This paper has been accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20396 2026-01-08 cs.LG 57%

BiListing: Modality Alignment for Listings

BiListing: 列表模态对齐

Guillaume Guy, Mihajlo Grbovic, Chun How Tan, Han Zhao

机构 * Airbnb

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 BiListing通过结合大型语言模型和预训练语言-图像模型,实现列表文本与照片的模态对齐,提升搜索效率并解决冷启动问题。

Journal ref Proceedings of the 34th ACM International Conference on Information and Knowledge Management, CIKM 2025

详情

展开后加载摘要…

URL PDF HTML 收藏