arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7583 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7583 篇

2508.11933 2025-08-19 cs.CL 77%

CAMF: Collaborative Adversarial Multi-agent Framework for Machine Generated Text Detection

Yue Wang, Liesheng Wei, Yuxiang Wang

机构 * Stanford University(斯坦福大学) College of Information Technology(信息科技学院) School of Business(商学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09363 2025-08-14 cs.LG 77%

Resurrecting the Salmon: Rethinking Mechanistic Interpretability with Domain-Specific Sparse Autoencoders

Charles O'Neill, Mudith Jayasekara, Max Kirkby

机构 * Parsed, London, UK(伦敦大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08228 2025-08-12 cs.GR cs.AI 77%

LL3M: Large Language 3D Modelers

Sining Lu, Guan Chen, Nam Anh Dinh, Itai Lang, Ari Holtzman, Rana Hanocka

机构 * University of Chicago(芝加哥大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Our project page is at https://threedle.github.io/ll3m

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04530 2025-08-08 cs.CL 77%

Balancing Stylization and Truth via Disentangled Representation Steering

Chenglei Shen, Zhongxiang Sun, Teng Shi, Xiao Zhang, Jun Xu

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学 Gallagher人工智能学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23736 2025-08-01 stat.ML cs.LG 77%

DICOM De-Identification via Hybrid AI and Rule-Based Framework for Scalable, Uncertainty-Aware Redaction

Kyle Naddeo, Nikolas Koutsoubis, Rahul Krish, Ghulam Rasool, Nidhal Bouaynaya, Tony OSullivan, Raj Krish

机构 * Rowan University(罗文大学) Moffitt Cancer Center(莫菲特癌症中心) University of South Florida(佛罗里达州立大学) Impact Business Information Solutions, Inc(Impact商务信息解决方案公司)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 15 pages, 6 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08450 2025-07-31 cs.CL 77%

IterKey: Iterative Keyword Generation with LLMs for Enhanced Retrieval Augmented Generation

Kazuki Hayashi, Hidetaka Kamigaito, Shinya Kouda, Taro Watanabe

机构 * Nara Institute of Science and Technology(奈良科学技術研究所) TDSE Inc.(TDSE公司)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21406 2025-07-30 cs.AI 77%

Shapley Uncertainty in Natural Language Generation

Meilin Zhu, Gaojie Jin, Xiaowei Huang, Lijun Zhang

机构 * University of Exeter(埃克塞特大学) University of Liverpool(利物浦大学) ISCAS(国际信息科学协会)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21141 2025-07-30 cs.AI 77%

The Geometry of Harmfulness in LLMs through Subconcept Probing

McNair Shah, Saleena Angeline, Adhitya Rajendra Kumar, Naitik Chheda, Kevin Zhu, Vasu Sharma, Sean O'Brien, Will Cai

机构 * Algoverse AI Research(Algoverse AI研究院) Berkeley(伯克利大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.09389 2025-07-15 cs.AI cs.CY cs.IR 77%

Knowledge Conceptualization Impacts RAG Efficacy

Chris Davis Jaldi, Anmol Saini, Elham Ghiasi, O. Divine Eziolise, Cogan Shimizu

机构 * Wright State University(怀特州立大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06949 2025-07-09 cs.SE cs.CL 77%

Towards Exception Safety Code Generation with Intermediate Representation Agents Framework

Xuanming Zhang, Yuxuan Chen, Yuan Yuan, Minlie Huang

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Stanford University(斯坦福大学) Tsinghua University(清华大学) Beihang University(北航大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03998 2025-07-08 cs.AI 77%

Toward Better Generalisation in Uncertainty Estimators: Leveraging Data-Agnostic Features

Thuy An Ha, Bao Quoc Vo

机构 * Swinburne University of Technology(斯威本理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01594 2025-07-03 cs.CL 77%

Emotionally Intelligent Task-oriented Dialogue Systems: Architecture, Representation, and Optimisation

Shutong Feng, Hsien-chin Lin, Nurul Lubis, Carel van Niekerk, Michael Heck, Benjamin Ruppik, Renato Vukovic, Milica Gašić

机构 * Heinrich Heine University Düsseldorf(海因里希·海因大学杜塞尔多夫)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20471 2025-06-26 cs.CL 77%

Probing AI Safety with Source Code

Ujwal Narayan, Shreyas Chaudhari, Ashwin Kalyan, Tanmay Rajpurohit, Karthik Narasimhan, Ameet Deshpande, Vishvak Murahari

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17864 2025-06-24 cs.CL 77%

QueueEDIT: Structural Self-Correction for Sequential Model Editing in LLMs

Taolin Zhang, Haidong Kang, Dongyang Li, Qizhou Chen, Chengyu Wang Xiaofeng He, Richang Hong

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02397 2025-06-23 cs.CL 77%

Learning to Refine with Fine-Grained Natural Language Feedback

Manya Wadhwa, Xinyu Zhao, Junyi Jessy Li, Greg Durrett

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments Code and models available at: https://github.com/ManyaWadhwa/DCR; Findings of EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11714 2025-06-19 cs.RO cs.AI 77%

Semantic-Geometric-Physical-Driven Robot Manipulation Skill Transfer via Skill Library and Tactile Representation

Mingchao Qi, Yuanjin Li, Xing Liu, Zhengxiong Liu, Panfeng Huang

机构 * Research Center for Intelligent Robotics, School of Astronautics, Northwestern Polytechnical University(智能机器人研究中心,航天学院,西北工业大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13978 2025-06-18 cs.CL 77%

AI shares emotion with humans across languages and cultures

Xiuwen Wu, Hao Wang, Zhiang Yan, Xiaohan Tang, Pengfei Xu, Wai-Ting Siok, Ping Li, Jia-Hong Gao, Bingjiang Lyu, Lang Qin

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12152 2025-06-17 cs.AI 77%

Because we have LLMs, we Can and Should Pursue Agentic Interpretability

Been Kim, John Hewitt, Neel Nanda, Noah Fiedel, Oyvind Tafjord

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07735 2025-06-10 cs.LG cs.CV 77%

Language Embedding Meets Dynamic Graph: A New Exploration for Neural Architecture Representation Learning

Haizhao Jing, Haokui Zhang, Zhenhao Shang, Rong Xiao, Peng Wang, Yanning Zhang

机构 * Northwestern Polytechnical University(西北工业大学) Intellifusion

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12584 2025-06-10 cs.CV cs.AI 77%

Leveraging MLLM Embeddings and Attribute Smoothing for Compositional Zero-Shot Learning

Xudong Yan, Songhe Feng, Yang Zhang, Jian Yang, Yueguan Lin, Haojun Fei

机构 * School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学) Qifu Technology(启福科技)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04290 2025-06-10 q-fin.RM cs.LG 77%

Interpretable LLMs for Credit Risk: A Systematic Review and Taxonomy

Muhammed Golec, Maha AlabdulJalil

机构 * School of Electronic Engineering and Computer Science, Queen Mary University of London(伦敦大学电子工程与计算机科学学院) Institute for Data Science and Artificial Intelligence, Boğaziçi University(博雅大学数据科学与人工智能研究所) College of Science Computer Science Department, Kuwait University(科威特大学科学学院计算机科学系)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 20 pages, 6 figures, updated author affiliation and removed prior submission note

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07965 2025-06-04 cs.CL 77%

SHARP: Unlocking Interactive Hallucination via Stance Transfer in Role-Playing LLMs

Chuyi Kong, Ziyang Luo, Hongzhan Lin, Zhiyuan Fan, Yaxin Fan, Yuxi Sun, Jing Ma

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);post-training(abstract);分类 cs.CL

Comments 28 pages, unfortunately accepted to findings with Meta 4, acknowledge and apologize to the reviewers and area chair who support our work in the discussion period

Journal ref ACL 2025 Finding

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08769 2025-06-04 cs.CL 77%

Lower Layers Matter: Alleviating Hallucination via Multi-Layer Fusion Contrastive Decoding with Truthfulness Refocused

Dingwei Chen, Feiteng Fang, Shiwen Ni, Feng Liang, Xiping Hu, Ahmadreza Argha, Hamid Alinejad-Rokny, Min Yang, Chengming Li

机构 * Sun Yat-Sen University(中山大学) Shenzhen MSU-BIT University(深圳MSU-BIT大学) UNSW, Sydney, NSW 2052, Australia(新南威尔士大学,悉尼,新南威尔士州,2052,澳大利亚) Shenzhen Key Laboratory for High Performance Data Mining, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳高性能数据挖掘关键实验室,深圳先进技术研究院,中国科学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18069 2025-06-03 cs.CL 77%

Improving Factuality with Explicit Working Memory

Mingda Chen, Yang Li, Karthik Padthe, Rulin Shao, Alicia Sun, Luke Zettlemoyer, Gargi Ghosh, Wen-tau Yih

机构 * Meta FAIR

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments ACL 2025 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00823 2025-06-03 cs.CL 77%

Probing the Geometry of Truth: Consistency and Generalization of Truth Directions in LLMs Across Logical Transformations and Question Answering Tasks

Yuntai Bao, Xuhong Zhang, Tianyu Du, Xinkui Zhao, Zhengwen Feng, Hao Peng, Jianwei Yin

机构 * Zhejiang University(浙江大学) Zhejiang Normal University(浙江师范大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

Comments 19 pages, 16 figures; accepted to Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00274 2025-06-03 cs.CR cs.AI 77%

Chances and Challenges of the Model Context Protocol in Digital Forensics and Incident Response

Jan-Niclas Hilgert, Carlo Jakobs, Michael Külper, Martin Lambertz, Axel Mahr, Elmar Padilla

机构 * Fraunhofer FKIE(弗劳恩霍夫研究所)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24650 2025-06-02 cs.CE cs.LG q-fin.ST 77%

Beyond the Black Box: Interpretability of LLMs in Finance

Hariom Tatsat, Ariye Shater

机构 * Barclays(巴克莱银行)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

Comments 28 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21701 2025-06-02 cs.CL 77%

Do We Know What LLMs Don't Know? A Study of Consistency in Knowledge Probing

Raoyuan Zhao, Abdullatif Köksal, Ali Modarressi, Michael A. Hedderich, Hinrich Schütze

机构 * LMU Munich(慕尼黑莱布尼茨大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23410 2025-05-30 cs.CL 77%

From Parameters to Prompts: Understanding and Mitigating the Factuality Gap between Fine-Tuned LLMs

Xuan Gong, Hanbo Huang, Shiyu Liang

机构 * Tongji University(同济大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL

Comments The code of this paper will be released soon

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23223 2025-05-30 cs.LG 77%

Daunce: Data Attribution through Uncertainty Estimation

Xingyuan Pan, Chenlu Ye, Joseph Melkonian, Jiaqi W. Ma, Tong Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Womp Labs(Womp实验室)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏