arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2025-09-19 至 2025-09-19 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 8 篇

2509.14554 2025-09-19 cs.CY 89%

Generative Large Language Models for Knowledge Representation: A Systematic Review of Concept Map Generation

Xiaoming Zhai

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20020 2025-09-19 cs.LG cs.AI 88%

Modular Machine Learning: An Indispensable Path towards New-Generation Large Language Models

Xin Wang, Haoyang Li, Haibo Chen, Zeyang Zhang, Wenwu Zhu

机构 * Department of Computer Science and Technology, BNRist, Tsinghua University(计算机科学与技术系,BNRist,清华大学)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 20 pages, 4 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16538 2025-09-19 cs.CL 88%

Mechanistic Understanding and Mitigation of Language Confusion in English-Centric Large Language Models

Ercong Nie, Helmut Schmid, Hinrich Schütze

机构 * Center for Information and Language Processing (CIS)(信息与语言处理中心) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

Comments Accepted to EMNLP 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14254 2025-09-19 cs.CL cs.AI 79%

Hallucination Detection with the Internal Layers of LLMs

Martin Preiß

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Master's thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14956 2025-09-19 cs.AI cs.MA 70%

Sentinel Agents for Secure and Trustworthy Agentic AI in Multi-Agent Systems

Diego Gosmar, Deborah A. Dahl

机构 * Head of AI Tesisquare(Tesisquare人工智能负责人) Voiceinteroperability.ai Initiative Member(Voiceinteroperability.ai 创始成员) Linux Foundation AI & Data(Linux基金会人工智能与数据) AI & Data Torino, TO 10100, Italy(人工智能与数据Torino, TO 10100, Italy) Principal Conversational Technologies(对话技术首席专家) Plymouth Meeting, Pennsylvania, USA(美国宾夕法尼亚州Plymouth Meeting)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 25 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11277 2025-09-19 cs.CV cs.LG 70%

Probing the Representational Power of Sparse Autoencoders in Vision Models

Matthew Lyle Olson, Musashi Hinck, Neale Ratzlaff, Changbai Li, Phillip Howard, Vasudev Lal, Shao-Yen Tseng

机构 * Oracle Intel Labs(英特尔实验室) Oregon State University(俄勒冈州立大学) Thoughtworks

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments ICCV 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19721 2025-09-19 cs.CL cs.CY 70%

Unsupervised Concept Vector Extraction for Bias Control in LLMs

Hannah Cyberey, Yangfeng Ji, David Evans

机构 * Department of Computer Science University of Virginia(计算机科学系 首都维吉尼亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14688 2025-09-19 cs.RO 50%

exUMI: Extensible Robot Teaching System with Action-aware Task-agnostic Tactile Representation

Yue Xu, Litao Wei, Pengyu An, Qingyu Zhang, Yong-Lu Li

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

专题命中 知识编辑与模型理解 :pretraining(abstract)

Comments Accepted at CoRL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏