arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7608 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7608 篇

2510.03799 2025-10-07 cs.CL cs.AI cs.CY 84%

Mechanistic Interpretability of Socio-Political Frames in Language Models

Hadi Asghari, Sami Nenno

机构 * Technische Universität Berlin, Berlin, Germany Humboldt Institute for Internet \& Society, Berlin, Germany

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Peer-reviewed and presented at Advances in Interpretable Machine Learning and Artificial Intelligence (AIMLAI) Workshop at ECML/PKDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18562 2025-10-07 cs.CL cs.AI 84%

From Word to World: Evaluate and Mitigate Culture Bias in LLMs via Word Association Test

Xunlian Dai, Li Zhou, Benyou Wang, Haizhou Li

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Research Institute of Big Data(深圳大数据研究院)

专题命中 知识编辑与模型理解 :large language model(abstract,comments);language model(abstract,comments);LLM(abstract);prompting(abstract)

Comments Cultural Analysis, Cultural Alignment, Word Association Test, Large Language Models. Accepted by EMNLP 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00476 2025-10-06 cs.SE cs.AI cs.LG 84%

Analyzing Latent Concepts in Code Language Models

Arushi Sharma, Vedant Pungliya, Christopher J. Quinn, Ali Jannesari

机构 * Iowa State University(爱荷华州立大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01288 2025-10-03 cs.LG cs.AI 84%

Microsaccade-Inspired Probing: Positional Encoding Perturbations Reveal LLM Misbehaviours

Rui Melo, Rui Abreu, Corina S. Pasareanu

机构 * Carnegie Mellon University(卡内基梅隆大学) FEUP(费拉尔大学) INESC-ID(葡萄牙里斯本信息技术与创新研究中心)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 9 main pages, 13 appendix pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11771 2025-09-26 cs.CL cs.AI 84%

The Validation Gap: A Mechanistic Analysis of How Language Models Compute Arithmetic but Fail to Validate It

Leonardo Bertolazzi, Philipp Mondorf, Barbara Plank, Raffaella Bernardi

机构 * DISI, University of Trento(特伦托大学DISI中心) MaiNLP, Center for Information and Language Processing, LMU Munich(慕尼黑大学信息与语言处理中心) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心) Free University of Bozen-Bolzano, Italy(博兹纳自由大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2025 Main, 38 pages, 33 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07974 2025-09-15 cs.SE cs.AI cs.LG 84%

From Hazard Identification to Controller Design: Proactive and LLM-Supported Safety Engineering for ML-Powered Systems

Yining Hong, Christopher S. Timperley, Christian Kästner

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication at the International Conference on AI Engineering (CAIN) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09265 2025-09-12 cs.LG cs.CL 84%

Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents

Jiawei Wang, Jiacai Liu, Yuqian Fu, Yingru Li, Xintao Wang, Yuan Lin, Yu Yue, Lin Zhang, Yang Wang, Ke Wang

机构 * ByteDance Seed(字节跳动种子)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICLR 2026 Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00673 2025-09-03 cs.CL cs.AI cs.IR 84%

Confident, Calibrated, or Complicit: Probing the Trade-offs between Safety Alignment and Ideological Bias in Language Models in Detecting Hate Speech

Sanjeeevan Selvaganapathy, Mehwish Nasim

机构 * School of Physics, Mathematics and Computing(物理、数学与计算学系) Network Analysis and Social Influence Modelling (NASIM) Lab(网络分析与社会影响建模实验室) The University of Western Australia(西澳大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20805 2025-08-29 cs.CL cs.AI cs.SD 84%

Exploring Machine Learning and Language Models for Multimodal Depression Detection

Javier Si Zhao Hong, Timothy Zoe Delaya, Sherwyn Chan Yin Kit, Pai Chet Ng, Xiaoxiao Miao

机构 * Singapore Institute of Technology(新加坡理工学院) Duke Kunshan University(杜克-昆山大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments This paper has been accepted by APCIPA ASC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14799 2025-08-28 cs.HC cs.AI cs.LG 84%

Analyzing Character Representation in Media Content using Multimodal Foundation Model: Effectiveness and Trust

Evdoxia Taka, Debadyuti Bhattacharya, Joanne Garde-Hansen, Sanjay Sharma, Tanaya Guha

机构 * University of Glasgow(格拉斯哥大学) University of Leeds(利兹大学) University of Warwick(沃里克大学)

专题命中 知识编辑与模型理解 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03678 2025-08-06 cs.CL cs.LG cs.PL 84%

More Than a Score: Probing the Impact of Prompt Specificity on LLM Code Generation

Yangtian Zi, Harshitha Menon, Arjun Guha

机构 * Northeastern University(东北大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03032 2025-07-28 cs.LG cs.CL 84%

Analyze Feature Flow to Enhance Interpretation and Steering in Language Models

Daniil Laptev, Nikita Balagansky, Yaroslav Aksenov, Daniil Gavrilov

机构 * mipt(莫斯科物理技术学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08622 2025-07-22 cs.AI cs.CL cs.CV 84%

Visually Guided Decoding: Gradient-Free Hard Prompt Inversion with Language Models

Donghoon Kim, Minji Bae, Kyuhong Shim, Byonghyo Shim

机构 * Seoul National University(首尔国立大学) Sungkyunkwan University(庆熙大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments ICLR 2025 (Official Code: https://github.com/DonghoonKim-1938/VGD)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12379 2025-07-17 cs.CL cs.AI 84%

Probing for Arithmetic Errors in Language Models

Yucheng Sun, Alessandro Stolfo, Mrinmaya Sachan

机构 * ETH Zürich(苏黎世联邦理工学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12240 2025-06-17 cs.LG cs.AI 84%

Mind the XAI Gap: A Human-Centered LLM Framework for Democratizing Explainable AI

Eva Paraschou, Ioannis Arapakis, Sofia Yfantidou, Sebastian Macaluso, Athena Vakali

机构 * Aristotle University of Thessaloniki, School of Informatics(塞萨洛尼基亚里士多德大学信息学院) Technical University of Denmark(丹麦技术大学) Telefonica Scientific Research(电信科学研究院)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication at The 3rd World Conference on eXplainable Artificial Intelligence. This version corresponds to the camera-ready manuscript submitted to the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11073 2025-06-16 cs.CL cs.AI cs.CV 84%

CLAIM: Mitigating Multilingual Object Hallucination in Large Vision-Language Models with Cross-Lingual Attention Intervention

Zekai Ye, Qiming Li, Xiaocheng Feng, Libo Qin, Yichong Huang, Baohang Li, Kui Jiang, Yang Xiang, Zhirui Zhang, Yunfei Lu, Duyu Tang, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) Central South University(中南大学) Huawei Technologies Co., Ltd(华为技术有限公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments ACL2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17626 2025-06-04 cs.LG cs.CL 84%

Tracking the Feature Dynamics in LLM Training: A Mechanistic Study

Yang Xu, Yi Wang, Hengguan Huang, Hao Wang

机构 * Department of Computer Science(计算机科学系) Rutgers University(罗格斯大学) Section for Health Data Science and AI(健康数据科学与人工智能部门) University of Copenhagen(哥本哈根大学)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01133 2025-06-03 cs.CL cs.AI cs.SD eess.AS 84%

From Words to Waves: Analyzing Concept Formation in Speech and Text-Based Foundation Models

Asım Ersoy, Basel Mousi, Shammur Chowdhury, Firoj Alam, Fahim Dalvi, Nadir Durrani

机构 * Qatar Computing Research Institute(卡塔尔计算研究所)

专题命中 知识编辑与模型理解 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted Interspeech 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00245 2025-06-03 cs.LG cs.CL 84%

Beyond Semantic Entropy: Boosting LLM Uncertainty Quantification with Pairwise Semantic Similarity

Dang Nguyen, Ali Payani, Baharan Mirzasoleiman

机构 * UCLA CS(UCLA计算机科学系) Cisco Systems Inc.(思科系统公司)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 11 pages, 4 figures, 6 tables, link: https://github.com/BigML-CS-UCLA/SNNE

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00198 2025-06-03 cs.LG cond-mat.mtrl-sci cs.AI 84%

MOFGPT: Generative Design of Metal-Organic Frameworks using Language Models

Srivathsan Badrinarayanan, Rishikesh Magar, Akshay Antony, Radheesh Sharma Meda, Amir Barati Farimani

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments 21 pages, 3 figures (in main text, without references)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23026 2025-06-03 cs.CL cs.AI 84%

Context-Robust Knowledge Editing for Language Models

Haewon Park, Gyubin Choi, Minjun Kim, Yohan Jo

机构 * Graduate School of Data Science, Seoul National University(首尔国立大学数据科学研究生院) School of Electrical Engineering and Computer Science, Gwangju Institute of Science and Technology(全州科学技术院电子工程与计算机科学学院)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2025 Findings. Our code and datasets are available at https://github.com/holi-lab/CoRE

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09674 2025-05-28 cs.CL cs.AI 84%

The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions

Wenbo Pan, Zhichao Liu, Qiguang Chen, Xiangyang Zhou, Haining Yu, Xiaohua Jia

机构 * Wenbo Pan(温波 Pan) Zhichao Liu(刘志超 Liu) Qiguang Chen(陈启广 Chen) Xiangyang Zhou(周祥阳 Zhou) Haining Yu(于航 Yu) Xiaohua Jia(贾小华 Jia)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Code and artifacts: https://github.com/BMPixel/safety-residual-space Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18933 2025-05-27 cs.AI cs.CL 84%

REACT: Representation Extraction And Controllable Tuning to Overcome Overfitting in LLM Knowledge Editing

Haitian Zhong, Yuhuan Liu, Ziyang Xu, Guofan Liu, Qiang Liu, Shu Wu, Zhe Zhao, Liang Wang, Tieniu Tan

机构 * NLPR, MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所国家信息处理实验室、人工智能研究所) Cuiying Honors College, Lanzhou University(兰州大学萃英荣誉学院) Department of Mathematics, The Chinese University of Hong Kong(香港中文大学数学系) Tencent(腾讯)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00290 2025-05-12 cs.CL cs.AI 84%

Estimating LLM Uncertainty with Evidence

Huan Ma, Jingdong Chen, Joey Tianyi Zhou, Guangyu Wang, Changqing Zhang

机构 * Tianjin University(天津大学) Beijing University of Posts and Telecommunications(北京邮电大学) A*STAR(新加坡科技研究局)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00626 2025-05-06 cs.CL cs.AI 84%

The Illusion of Role Separation: Hidden Shortcuts in LLM Role Learning (and How to Fix Them)

Zihao Wang, Yibo Jiang, Jiahao Yu, Heqing Huang

机构 * Zihao Wang(独立研究者)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00004 2025-05-02 cs.CL cs.AI 84%

LangVAE and LangSpace: Building and Probing for Language Model VAEs

Danilo S. Carvalho, Yingji Zhang, Harriet Unsworth, André Freitas

机构 * National Biomarker Centre, CRUK-MI, University of Manchester, United Kingdom(国家生物标志物中心、CRUK-MI、曼彻斯特大学、英国) Department of Computer Science, University of Manchester, United Kingdom(计算机科学系、曼彻斯特大学、英国) Idiap Research Institute, Switzerland(Idiap研究机构、瑞士)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21559 2025-05-01 cs.CV cs.AI cs.CL 84%

Black-Box Visual Prompt Engineering for Mitigating Object Hallucination in Large Vision Language Models

Sangmin Woo, Kang Zhou, Yun Zhou, Shuai Wang, Sheng Guan, Haibo Ding, Lin Lee Cheong

专题命中 知识编辑与模型理解 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02355 2025-04-23 cs.CL cs.AI 84%

AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models

Junfeng Fang, Houcheng Jiang, Kun Wang, Yunshan Ma, Shi Jie, Xiang Wang, Xiangnan He, Tat-seng Chua

机构 * University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Journal ref 13th International Conference on Learning Representations (ICLR 2025 Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07831 2025-04-11 cs.AI cs.CL 84%

Deceptive Automated Interpretability: Language Models Coordinating to Fool Oversight Systems

Simon Lermen, Mateusz Dziemian, Natalia Pérez-Campanero Antolín

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07304 2025-04-11 cs.CL cs.AI 84%

PAYADOR: A Minimalist Approach to Grounding Language Models on Structured Data for Interactive Storytelling and Role-playing Games

Santiago Góngora, Luis Chiruzzo, Gonzalo Méndez, Pablo Gervás

专题命中 知识编辑与模型理解 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Presented at the 15th International Conference on Computational Creativity (ICCC'24)

Journal ref Proceedings of the Fifteenth International Conference on Computational Creativity (2024) 101-106

详情

展开后加载摘要…

URL PDF HTML 收藏