arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-10-20 至 2025-10-20 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 11 篇

2510.15017 2025-10-20 cs.CR cs.AI 85%

Active Honeypot Guardrail System: Probing and Confirming Multi-Turn LLM Jailbreaks

ChenYu Wu, Yi Wang, Yang Liao

机构 * Wuhan, China(中国武汉) The University of Tokyo(东京大学) Xi’an Jiaotong University(西安交通大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments 6pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15729 2025-10-20 cs.IR 85%

FACE: A General Framework for Mapping Collaborative Filtering Embeddings into LLM Tokens

Chao Wang, Yixin Song, Jinhui Ye, Chuan Qin, Dazhong Shen, Lingfeng Liu, Xiang Wang, Yanyong Zhang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15804 2025-10-20 cs.CL 83%

Emergence of Linear Truth Encodings in Language Models

Shauli Ravfogel, Gilad Yehudai, Tal Linzen, Joan Bruna, Alberto Bietti

机构 * New York University(纽约大学) Flatiron Institute(Flatiron研究所)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted in Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10201 2025-10-20 cs.CL cs.AI 79%

Prediction hubs are context-informed frequent tokens in LLMs

Beatrix M. G. Nielsen, Iuri Macocco, Marco Baroni

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published as a conference paper at ACL 2025

Journal ref Association for Computational Linguistics 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15543 2025-10-20 cs.CL cs.AI cs.IR cs.MM 73%

MCA: Modality Composition Awareness for Robust Composed Multimodal Retrieval

Qiyu Wu, Shuyang Cui, Satoshi Hayakawa, Wei-Yao Wang, Hiromi Wakaki, Yuki Mitsufuji

机构 * Sony Group Corporation(索尼集团公司) Sony AI(索尼人工智能)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12672 2025-10-20 cs.LG 70%

Keep Calm and Avoid Harmful Content: Concept Alignment and Latent Manipulation Towards Safer Answers

Ruben Belo, Marta Guimaraes, Claudia Soares

机构 * Neuraspace(Neuraspace公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15094 2025-10-20 cs.LG 70%

Evaluating Sparse Autoencoders for Monosemantic Representation

Moghis Fereidouni, Muhammad Umair Haider, Peizhong Ju, A. B. Siddique

机构 * University of Kentucky(肯塔基大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12276 2025-10-20 cs.RO 67%

Spatial Forcing: Implicit Spatial Representation Alignment for Vision-language-action Model

Fuhao Li, Wenxuan Song, Han Zhao, Jingbo Wang, Pengxiang Ding, Donglin Wang, Long Zeng, Haoang Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Tsinghua University(清华大学) Westlake University(西湖大学) Zhejiang University(浙江大学) South China University of Technology(华南理工大学)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09863 2025-10-20 cs.LG cs.CL stat.ML 62%

Closed-Form Training Dynamics Reveal Learned Features and Linear Structure in Word2Vec-like Models

Dhruva Karkada, James B. Simon, Yasaman Bahri, Michael R. DeWeese

机构 * UC Berkeley(伯克利大学) Imbue(Imbue公司) Google DeepMind(谷歌DeepMind)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.LG

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15115 2025-10-20 cs.CL 57%

Measuring the Effect of Disfluency in Multilingual Knowledge Probing Benchmarks

Kirill Semenov, Rico Sennrich

机构 * University of Zurich(苏黎世大学)

专题命中 知识编辑与模型理解 :LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13916 2025-10-20 cs.CL 57%

Element2Vec: Build Chemical Element Representation from Text for Property Prediction

Yuanhao Li, Keyuan Lai, Tianqi Wang, Qihao Liu, Jiawei Ma, Yuan-Chao Hu

机构 * Songshan Lake Materials Laboratory(松山湖材料实验室) International Academic Center of Complex Systems, Beijing Normal University(复杂系统国际学术中心,北京师范大学) Department of Applied Physics, The Hong Kong Polytechnic University(应用物理系,香港理工大学) Department of Computer Science, City University of Hong Kong (Dongguan)(计算机科学系,香港城市大学(东莞)) Department of Computer Science, City University of Hong Kong(计算机科学系,香港城市大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏