arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7584 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7584 篇

2506.15538 2025-11-13 cs.LG cs.AI cs.CL 75%

Capturing Polysemanticity with PRISM: A Multi-Concept Feature Description Framework

Laura Kopf, Nils Feldhus, Kirill Bykov, Philine Lou Bommer, Anna Hedström, Marina M. -C. Höhne, Oliver Eberle

机构 * Technische Universität Berlin(柏林技术大学) BIFOLD UMI Lab(UMI实验室) Fraunhofer Heinrich-Hertz-Institute(弗劳恩霍夫海因里希-赫兹研究所) ETH AI Center(苏黎世联邦理工学院人工智能中心) Universität Potsdam(波茨坦大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25488 2025-10-30 cs.IR 75%

Generalized Pseudo-Relevance Feedback

Yiteng Tu, Weihang Su, Yujia Zhou, Yiqun Liu, Fen Lin, Qin Liu, Qingyao Ai

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17477 2025-10-27 cs.CL cs.AI cs.LG 75%

Do Robot Snakes Dream like Electric Sheep? Investigating the Effects of Architectural Inductive Biases on Hallucination

Jerry Huang, Prasanna Parthasarathi, Mehdi Rezagholizadeh, Boxing Chen, Sarath Chandar

机构 * Mila & Université de Montréal(Mila与蒙特利尔大学) Noah’s Ark Lab(Noah’s Ark实验室) Advanced Micro Devices Chandar Research Lab(Chandar研究实验室) Polytechnique Montréal(蒙特利尔理工学院) CIFAR AI Chair(CIFAR人工智能主席)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to Findings of The 63rd Annual Meeting of the Association for Computational Linguistics (ACL) 2025. Official proceedings version available at https://aclanthology.org/2025.findings-acl.60/

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14144 2025-10-24 cs.CL cs.AI cs.LG 75%

Towards Understanding Safety Alignment: A Mechanistic Perspective from Safety Neurons

Jianhui Chen, Xiaozhi Wang, Zijun Yao, Yushi Bai, Lei Hou, Juanzi Li

机构 * Department of Computer Science and Technology, BNRist(计算机科学与技术系,BNRist) Shenzhen International Graduate School(深圳国际研究生院) KIRC, Institute for Artificial Intelligence, Tsinghua University(人工智能研究院,清华大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17598 2025-10-21 cs.LG cs.AI cs.CL 75%

Hallucination Detection in LLMs Using Spectral Features of Attention Maps

Jakub Binkowski, Denis Janiak, Albert Sawczyn, Bogdan Gabrys, Tomasz Kajdanowicz

机构 * Wroclaw University of Science and Technology(沃拉日-克拉夫大学科学与技术学院) University of Technology Sydney(悉尼技术大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2025. Code available at https://github.com/graphml-lab-pwr/lapeigvals

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14262 2025-10-17 cs.LG cs.AI cs.CL 75%

CAST: Compositional Analysis via Spectral Tracking for Understanding Transformer Layer Functions

Zihao Fu, Ming Liao, Chris Russell, Zhenguang G. Cai

机构 * The Chinese University of Hong Kong(香港中文大学) Hong Kong Polytechnic University(香港理工大学) University of Oxford(牛津大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.09642 2025-10-16 cs.LG cs.AI cs.CL cs.DS stat.ML 75%

On the Limits of Language Generation: Trade-Offs Between Hallucination and Mode Collapse

Alkis Kalavasis, Anay Mehrotra, Grigoris Velegkas

机构 * Yale University(耶鲁大学)

专题命中 知识编辑与模型理解 :language model(abstract);post-training(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for presentation at the 57th Symposium on Theory of Computing (STOC 2025); v3 fixes typos

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08855 2025-10-13 cs.LG cs.AI cs.CL 75%

Time-Aware Feature Selection: Adaptive Temporal Masking for Stable Sparse Autoencoder Training

T. Ed Li, Junyu Ren

机构 * Yale University(耶鲁大学) University of Chicago(芝加哥大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments First submitted on February 10th, 2025 to ICLR 2025 Workshop (XAI4Science: From Understanding Model Behavior to Discovering New Scientific Knowledge). The paper was accepted but the workshop does not generate proceedings. Now uploading to arXiv to make the paper publicly available

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02173 2025-10-10 cs.CL cs.AI cs.LG 75%

Learning to Reason for Hallucination Span Detection

Hsuan Su, Ting-Yao Hu, Hema Swetha Koppula, Kundan Krishna, Hadi Pouransari, Cheng-Yu Hsieh, Cem Koc, Joseph Yitan Cheng, Oncel Tuzel, Raviteja Vemulapalli

机构 * National Taiwan University(国立台湾大学) Apple(苹果公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03659 2025-10-07 cs.LG cs.AI cs.CL stat.ML 75%

Does higher interpretability imply better utility? A Pairwise Analysis on Sparse Autoencoders

Xu Wang, Yan Hu, Benyou Wang, Difan Zou

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学) School of Data Science, The Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00404 2025-10-03 cs.LG cs.AI cs.CL 75%

AbsTopK: Rethinking Sparse Autoencoders For Bidirectional Features

Xudong Zhu, Mohammad Mahdi Khalili, Zhihui Zhu

机构 * Department of Computer Science & Engineering, The Ohio State University(计算机科学与工程系,俄亥俄州立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11895 2025-10-02 cs.CL cs.AI cs.LG 75%

Resolving UnderEdit & OverEdit with Iterative & Neighbor-Assisted Model Editing

Bhiman Kumar Baghel, Emma Jordan, Zheyuan Ryan Shi, Xiang Lorraine Li

机构 * Department of Computer Science, University of Pittsburgh, PA, USA(计算机科学系,匹兹堡大学,宾夕法尼亚州,美国)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at EMNLP 2025 as Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21086 2025-09-26 cs.CV 75%

UniTransfer: Video Concept Transfer via Progressive Spatial and Timestep Decomposition

Guojun Lei, Rong Zhang, Chi Wang, Tianhang Liu, Hong Li, Zhiyuan Ma, Weiwei Xu

机构 * State Key Lab of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) Tsinghua University(清华大学) Zhejiang Gongshang University(浙江工商大学) Beihang University(北航大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);pretraining(abstract)

Comments NeuriIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13140 2025-09-23 cs.NI 75%

RIDAS: A Multi-Agent Framework for AI-RAN with Representation- and Intention-Driven Agents

Kuiyuan Ding, Caili Guo, Yang Yang, Jianzhang Guo

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19668 2025-09-22 eess.SP cs.AI cs.CL cs.LG 75%

SuPreME: A Supervised Pre-training Framework for Multimodal ECG Representation Learning

Mingsheng Cai, Jiuming Jiang, Wenhao Huang, Che Liu, Rossella Arcucci

机构 * The University of Edinburgh(爱丁堡大学) Imperial College London(帝国理工学院) Shenzhen Yinwang Intelligent Technology Co., Ltd(深圳英伟达智能技术有限公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Findings of The 2025 Conference on Empirical Methods in Natural Language Processing (EMNLP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04335 2025-09-16 cs.CL cs.AI cs.LG 75%

Hallucinated Span Detection with Multi-View Attention Features

Yuya Ogasa, Yuki Arase

机构 * Grad. Sch. of Information Science and Tech.(信息科学与技术研究生院) The University of Osaka(大阪大学) School of Computing(计算学部) Institute of Science(科学研究所) LY Corporation(LY公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08912 2025-09-12 cs.CY cs.HC 75%

Towards Trustworthy AI: Characterizing User-Reported Risks across LLMs "In the Wild"

Lingyao Li, Renkai Ma, Zhaoqian Xue, Junjie Xiong

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06233 2025-09-09 cs.RO cs.CV 75%

O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation

Tongxuan Tian, Xuhui Kang, Yen-Ling Kuo

机构 * University of Virginia(弗吉尼亚大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract)

Comments Conference on Robot Learning (CoRL) 2025. Project website: https://o3afford.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15875 2025-08-25 cs.CL cs.AI cs.LG 75%

NEAT: Concept driven Neuron Attribution in LLMs

Vivek Hruday Kavuri, Gargi Shroff, Rahul Mishra

机构 * IIIT Hyderabad(IIIT海得拉巴)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13908 2025-08-20 physics.ed-ph 75%

Translating the Force Concept Inventory in the age of AI

Marina Babayeva, Justin Dunlap, Marie Snětinová, Ralf Widenhorn

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13729 2025-08-20 cs.CL cs.AI cs.LG 75%

Prediction is not Explanation: Revisiting the Explanatory Capacity of Mapping Embeddings

Hanna Herasimchyk, Alhassan Abdelhalim, Sören Laue, Michaela Regneri

机构 * Universität Hamburg(汉堡大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 6 Figures. Published at ECAI 2025 in a version without the Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07405 2025-08-12 cs.AI cs.CL cs.LG 75%

Generative AI for Strategic Plan Development

Jesse Ponnock

机构 * Johns Hopkins University(约翰霍普金斯大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 11 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01091 2025-08-05 cs.CY 75%

Disaggregated Health Data in LLMs: Evaluating Data Equity in the Context of Asian American Representation

Uvini Balasuriya Mudiyanselage, Bharat Jayprakash, Kookjin Lee, K. Hazel Kwon

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07360 2025-08-05 cs.CL cs.AI cs.LG 75%

Enhancing Time Series Forecasting via Multi-Level Text Alignment with LLMs

Taibiao Zhao, Xiaobing Chen, Mingxuan Sun

机构 * Louisiana State University(路易斯安那州立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments This paper is accepted by DASFAA2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03542 2025-07-10 cs.CV 75%

Beyond Accuracy: Metrics that Uncover What Makes a 'Good' Visual Descriptor

Ethan Lin, Linxi Zhao, Atharva Sehgal, Jennifer J. Sun

机构 * Cornell University(康奈尔大学) University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 知识编辑与模型理解 :LLM(abstract);language model(abstract);foundation model(abstract)

Comments VisCon @ CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17477 2025-07-10 cs.CL cs.AI cs.LG cs.SI 75%

Detecting mental disorder on social media: a ChatGPT-augmented explainable approach

Loris Belcastro, Riccardo Cantini, Fabrizio Marozzo, Domenico Talia, Paolo Trunfio

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Online Social Networks and Media, 100321, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05607 2025-07-09 cs.RO 75%

Structured Task Solving via Modular Embodied Intelligence: A Case Study on Rubik's Cube

Chongshan Fan, Shenghai Yuan

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11576 2025-07-03 cs.CV 75%

DCBM: Data-Efficient Visual Concept Bottleneck Models

Katharina Prasse, Patrick Knab, Sascha Marton, Christian Bartelt, Margret Keuper

机构 * Data and Web Science Group, University of Mannheim, Mannheim, Germany(曼海姆大学数据与网络科学小组) Clausthal University of Technology, Clausthal, Germany(克虏格大学) Max-Planck-Institute for Informatics, Saarland Informatics Campus(马克斯·普朗克信息研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01299 2025-07-01 cs.CL cs.AI cs.LG 75%

The Effectiveness of LLMs as Annotators: A Comparative Overview and Empirical Analysis of Direct Representation

Maja Pavlovic, Massimo Poesio

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments LREC-COLING NLPerspectives workshop

Journal ref https://aclanthology.org/2024.nlperspectives-1.11/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.04975 2025-06-24 cs.CV 75%

V2C-CBM: Building Concept Bottlenecks with Vision-to-Concept Tokenizer

Hangzhou He, Lei Zhu, Xinliang Zhang, Shuang Zeng, Qian Chen, Yanye Lu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract)

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏