arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2509.22831 2025-09-30 cs.AI cs.CL 86%

Toward a Theory of Generalizability in LLM Mechanistic Interpretability Research

Sean Trott

机构 * Department of Cognitive Science University of California, San Diego(认知科学系加州大学圣地亚哥分校)

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.20079 2025-09-30 cs.CL cs.AI 86%

Molecular Facts: Desiderata for Decontextualization in LLM Fact Verification

Anisha Gunjal, Greg Durrett

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2024 (2024) 3751-3768

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18136 2025-09-24 cs.LG cs.AI 86%

From Parameters to Performance: A Data-Driven Study on LLM Structure and Development

Suqing Wang, Zuchao Li, Luohe Shi, Bo Du, Hai Zhao, Yun Li, Qianren Wang

机构 * School of Artificial Intelligence, Wuhan University(武汉大学人工智能学院) School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机学院) Cognitive AI Lab, Shanghai Huawei Technologies, China(上海华为技术有限公司认知人工智能实验室)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08760 2025-09-23 cs.NI cs.AI cs.LG cs.SE 86%

INTA: Intent-Based Translation for Network Configuration with LLM Agents

Yunze Wei, Xiaohui Xie, Tianshuo Hu, Yiwei Zuo, Xinyi Chen, Kaiwen Chi, Yong Cui

机构 * Department of Computer Science and Technology, Tsinghua University(计算机科学与技术系,清华大学) Australian National University(澳大利亚国立大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by The 33rd IEEE International Conference on Network Protocols (IEEE ICNP 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09931 2025-09-16 cs.LG cs.AI 86%

Mechanistic Interpretability of LoRA-Adapted Language Models for Nuclear Reactor Safety Applications

Yoon Pyo Lee

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for publication in Nuclear Technology. 24 pages, 2 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05360 2025-09-09 cs.CL cs.LG 86%

Beyond ROUGE: N-Gram Subspace Features for LLM Hallucination Detection

Jerry Li, Evangelos Papalexakis

机构 * University of California, Riverside(加州大学河滨分校)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04464 2025-09-08 cs.CL cs.AI 86%

Can Multiple Responses from an LLM Reveal the Sources of Its Uncertainty?

Yang Nan, Pengfei He, Ravi Tandon, Han Xu

机构 * University of Arizona(亚利桑那大学) Michigan State University(密歇根州立大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Proceedings of The 2025 Conference on Empirical Methods in Natural Language Processing (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21520 2025-08-26 cs.LG cs.CL 86%

LLM-Forest: Ensemble Learning of LLMs with Graph-Augmented Prompts for Data Imputation

Xinrui He, Yikun Ban, Jiaru Zou, Tianxin Wei, Curtiss B. Cook, Jingrui He

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Mayo Clinic Arizona(梅奥诊所阿兹根)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13152 2025-08-19 cs.CL cs.AI 86%

RepreGuard: Detecting LLM-Generated Text by Revealing Hidden Representation Patterns

Xin Chen, Junchao Wu, Shu Yang, Runzhe Zhan, Zeyu Wu, Ziyang Luo, Di Wang, Min Yang, Lidia S. Chao, Derek F. Wong

机构 * NLP(自然语言处理) CT Lab, Department of Computer and Information Science, University of Macau(计算机与信息科学系,澳门大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) Provable Responsible AI and Data Analytics Lab, KAUST(可证明责任AI与数据分析实验室,卡尔斯兰大学) Hong Kong Baptist University(香港 Baptist 大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to TACL 2025. This version is a pre-MIT Press publication version

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07517 2025-08-12 cs.CL cs.AI cs.HC 86%

Word Clouds as Common Voices: LLM-Assisted Visualization of Participant-Weighted Themes in Qualitative Interviews

Joseph T. Colonel, Baihan Lin

机构 * Icahn School of Medicine at Mount Sinai(伊卡恩医学院辛辛那提分校)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06306 2025-08-11 cs.CL cs.AI cs.HC 86%

Humans overrely on overconfident language models, across languages

Neil Rathi, Dan Jurafsky, Kaitlyn Zhou

机构 * Stanford University(斯坦福大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13411 2025-07-21 cs.CL cs.AI 86%

Aligning Knowledge Graphs and Language Models for Factual Accuracy

Nur A Zarin Nishat, Andrea Coletta, Luigi Bellomarini, Kossi Amouzouvi, Jens Lehmann, Sahar Vahdati

机构 * TIB – Leibniz Information Centre for Science and Technology(莱比锡信息科学与技术研究中心) Amazon, Germany(亚马逊公司)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08427 2025-07-14 cs.CL cs.AI 86%

ChainEdit: Propagating Ripple Effects in LLM Knowledge Editing through Logical Rule-Guided Chains

Zilu Dong, Xiangqing Shen, Zinong Yang, Rui Xia

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology, China(计算机科学与工程学院,南京理工大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09066 2025-07-08 cs.LG cs.AI cs.CR 86%

Probing Latent Subspaces in LLM for AI Security: Identifying and Manipulating Adversarial States

Xin Wei Chia, Swee Liang Wong, Jonathan Pan

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17296 2025-06-24 cs.CL cs.AI 86%

Semantic uncertainty in advanced decoding methods for LLM generation

Darius Foodeei, Simin Fan, Martin Jaggi

机构 * EPFL, Lausanne Switzerland(日内瓦联邦理工学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18841 2025-06-17 cs.CY cs.AI cs.CL 86%

Navigating LLM Ethics: Advancements, Challenges, and Future Directions

Junfeng Jiao, Saleh Afroogh, Yiming Xu, Connor Phillips

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01114 2025-06-03 cs.LG cs.AI 86%

Reconsidering LLM Uncertainty Estimation Methods in the Wild

Yavuz Bakman, Duygu Nur Yaldiz, Sungmin Kang, Tuo Zhang, Baturalp Buyukates, Salman Avestimehr, Sai Praneeth Karimireddy

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted to ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22571 2025-06-02 cs.CL cs.AI cs.DB cs.IR 86%

Agent-UniRAG: A Trainable Open-Source LLM Agent Framework for Unified Retrieval-Augmented Generation Systems

Hoang Pham, Thuy-Duong Nguyen, Khac-Hoai Nam Bui

机构 * Viettel Group(越通集团) Hanoi University of Science and Technology(河内科学技术大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00602 2025-05-29 cs.CL cs.LG 86%

Mitigating Heterogeneous Token Overfitting in LLM Knowledge Editing

Tianci Liu, Ruirui Li, Zihan Dong, Hui Liu, Xianfeng Tang, Qingyu Yin, Linjun Zhang, Haoyu Wang, Jing Gao

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18847 2025-05-27 cs.AI cs.CL 86%

Signal, Image, or Symbolic: Exploring the Best Input Representation for Electrocardiogram-Language Models Through a Unified Framework

William Han, Chaojing Duan, Zhepeng Cen, Yihang Yao, Xiaoyu Song, Atharva Mhaskar, Dylan Leong, Michael A. Rosenberg, Emerson Liu, Ding Zhao

机构 * Carnegie Mellon University(卡内基梅隆大学) Allegheny Health Network(阿勒格尼医疗网络) University of Colorado(科罗拉多大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 29 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16113 2025-05-23 cs.LG cs.CL 86%

Tools in the Loop: Quantifying Uncertainty of LLM Question Answering Systems That Use Tools

Panagiotis Lymperopoulos, Vasanth Sarathy

机构 * Tufts University(塔夫茨大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 10 pages 3 figures 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15710 2025-05-22 cs.CL cs.LG 86%

Advancing LLM Safe Alignment with Safety Representation Ranking

Tianqi Du, Zeming Wei, Quan Chen, Chenheng Zhang, Yisen Wang

机构 * State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,智能科学与技术学院,北京大学) School of Mathematical Sciences, Peking University(数学科学学院,北京大学) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07610 2025-05-20 cs.CL cs.AI 86%

Concept-Level Explainability for Auditing & Steering LLM Responses

Kenza Amara, Rita Sevastjanova, Mennatallah El-Assady

机构 * Department of Computer Science ETH Zurich(计算机科学系 苏黎世联邦理工学院)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 9 pages, 7 figures, Submission to Neurips 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02707 2025-05-20 cs.CL cs.AI 86%

LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations

Hadas Orgad, Michael Toker, Zorik Gekhman, Roi Reichart, Idan Szpektor, Hadas Kotek, Yonatan Belinkov

机构 * Technion(技术学院) Google Research(谷歌研究) Apple(苹果公司)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08946 2025-05-20 cs.LG cs.CL cs.CY 86%

Usable XAI: 10 Strategies Towards Exploiting Explainability in the LLM Era

Xuansheng Wu, Haiyan Zhao, Yaochen Zhu, Yucheng Shi, Fan Yang, Lijie Hu, Tianming Liu, Xiaoming Zhai, Wenlin Yao, Jundong Li, Mengnan Du, Ninghao Liu

机构 * University of Georgia(佐治亚大学) New Jersey Institute of Technology(新泽西理工学院) University of Virginia(弗吉尼亚大学) Wake Forest University(威克森林大学) King Abdullah University of Science and Technology(国王阿卜杜勒阿齐兹大学) Amazon(亚马逊)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 43 pages, 6 figures, including the latest works published in 2024-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08200 2025-05-14 cs.CL cs.AI 86%

A Head to Predict and a Head to Question: Pre-trained Uncertainty Quantification Heads for Hallucination Detection in LLM Outputs

Artem Shelmanov, Ekaterina Fadeeva, Akim Tsvigun, Ivan Tsvigun, Zhuohan Xie, Igor Kiselev, Nico Daheim, Caiqi Zhang, Artem Vazhentsev, Mrinmaya Sachan, Preslav Nakov, Timothy Baldwin

机构 * MBZUAI ETH Zürich(苏黎世联邦理工学院) University of Cambridge(剑桥大学) Behavox Accenture Computational Semantics Group(语义计算小组)

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04462 2025-04-08 cs.CL cs.AI 86%

An overview of model uncertainty and variability in LLM-based sentiment analysis. Challenges, mitigation strategies and the role of explainability

David Herrera-Poyatos, Carlos Peláez-González, Cristina Zuheros, Andrés Herrera-Poyatos, Virilo Tejedor, Francisco Herrera, Rosana Montes

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 25 pages and 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04755 2025-03-03 cs.CR cs.AI cs.HC cs.LG 86%

LLM Whisperer: An Inconspicuous Attack to Bias LLM Responses

Weiran Lin, Anna Gerchanovsky, Omer Akgul, Lujo Bauer, Matt Fredrikson, Zifan Wang

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.04344 2025-02-17 cs.LG cs.CL cs.CV 86%

Verbalized Machine Learning: Revisiting Machine Learning with Language Models

Tim Z. Xiao, Robert Bamler, Bernhard Schölkopf, Weiyang Liu

专题命中 知识编辑与模型理解 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Published in Transactions on Machine Learning Research (116 pages, 32 figures, v3: refined the paper structure and added more empirical results)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08109 2025-02-13 cs.CL cs.AI 86%

HuDEx: Integrating Hallucination Detection and Explainability for Enhancing the Reliability of LLM responses

Sujeong Lee, Hayoung Lee, Seongsoo Heo, Wonik Choi

专题命中 知识编辑与模型理解 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏