arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7583 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7583 篇

2402.11005 2025-07-11 cs.CL cs.AI 79%

A Theory of Response Sampling in LLMs: Part Descriptive and Part Prescriptive

Sarath Sivaprasad, Pramod Kaushik, Sahar Abdelnabi, Mario Fritz

机构 * CISPA Helmholtz Center for Information Security(CISPA霍普夫中心信息安全研究所) TCS Research, Pune(TCS研究 Pune) Microsoft(微软)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02932 2025-07-08 cs.LG cs.AI cs.CE 79%

MolProphecy: Bridging Medicinal Chemists' Knowledge and Molecular Pre-Trained Models via a Multi-Modal Framework

Jianping Zhao, Qiong Zhou, Tian Wang, Yusi Fan, Qian Yang, Li Jiao, Chang Liu, Zhehao Guo, Qi Lu, Fengfeng Zhou, Ruochi Zhang

机构 * College of Computer Science and Technology, Changchun University of Science and Technology(长春理工大学计算机科学与技术学院) Department of Chemical and Biological Engineering, The Hong Kong University of Science and Technology(香港科技大学化学与生物工程系) Key Laboratory of Symbolic Computation and Knowledge Engineering, Ministry of Education, Jilin University(吉林大学符号计算与知识工程重点实验室) Communication University of China(通信大学) Beijing Life Science Academy(北京生命科学研究院) College of Computer Science and Technology, Jilin University(吉林大学计算机科学与技术学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 16 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01321 2025-07-03 cs.LG cs.AI cs.CR 79%

ICLShield: Exploring and Mitigating In-Context Learning Backdoor Attacks

Zhiyao Ren, Siyuan Liang, Aishan Liu, Dacheng Tao

机构 * Nanyang Technological University(南洋理工大学) Beihang University(北航大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23055 2025-07-01 cs.LG cs.AI 79%

Measuring How LLMs Internalize Human Psychological Concepts: A preliminary analysis

Hiro Taiyo Hamada, Ippei Fujisawa, Genji Kawakita, Yuki Yamada

机构 * R&D Department Araya inc.(阿莱亚公司研发部) Department of Computational Neuroscience(计算神经科学系) Kyusyu University(九州大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11129 2025-06-16 cs.CL cs.AI 79%

Trustworthy AI for Medicine: Continuous Hallucination Detection and Elimination with CHECK

Carlos Garcia-Fernandez, Luis Felipe, Monique Shotande, Muntasir Zitu, Aakash Tripathi, Ghulam Rasool, Issam El Naqa, Vivek Rudrapatna, Gilmer Valdes

机构 * Department of Machine Learning, Moffitt Cancer Center(机器学习部门,莫菲特癌症中心) Department of Medicine, University of California San Francisco(医学部门,加州大学旧金山分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09742 2025-06-12 cs.LG cs.AI 79%

Feature Engineering for Agents: An Adaptive Cognitive Architecture for Interpretable ML Monitoring

Gusseppe Bravo-Rocca, Peini Liu, Jordi Guitart, Rodrigo M Carrillo-Larco, Ajay Dholakia, David Ellison

机构 * Barcelona Supercomputing Center(巴塞罗那超级计算中心) Universitat Politècnica de Catalunya(加泰罗尼亚理工大学) Emory University(埃默里大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at AAMAS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07448 2025-06-10 cs.LG cs.AI 79%

Extending Epistemic Uncertainty Beyond Parameters Would Assist in Designing Reliable LLMs

T. Duy Nguyen-Hien, Desi R. Ivanova, Yee Whye Teh, Wee Sun Lee

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04762 2025-06-10 cs.IR cs.AI cs.CL 79%

GOLFer: Smaller LM-Generated Documents Hallucination Filter & Combiner for Query Expansion in Information Retrieval

Lingyuan Liu, Mengxiang Zhang

机构 * City University of Hong Kong(香港城市大学) The University of Hong Kong(香港大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06862 2025-06-10 cs.RO cs.AI cs.CV cs.LG cs.SD eess.AS 79%

Multimodal Spatial Language Maps for Robot Navigation and Manipulation

Chenguang Huang, Oier Mees, Andy Zeng, Wolfram Burgard

机构 * University of Technology Nuremberg(图恩堡技术大学) UC Berkeley(伯克利大学) Google Research(谷歌研究)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments accepted to International Journal of Robotics Research (IJRR). 24 pages, 18 figures. The paper contains texts from VLMaps(arXiv:2210.05714) and AVLMaps(arXiv:2303.07522). The project page is https://mslmaps.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05497 2025-06-09 cs.LG cs.AI 79%

Conformal Prediction Beyond the Seen: A Missing Mass Perspective for Uncertainty Quantification in Generative Models

Sima Noorani, Shayan Kiyani, George Pappas, Hamed Hassani

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14830 2025-06-03 cs.CL cs.AI 79%

Middle-Layer Representation Alignment for Cross-Lingual Transfer in Fine-Tuned LLMs

Danni Liu, Jan Niehues

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16520 2025-06-02 cs.CL cs.AI 79%

Are the Hidden States Hiding Something? Testing the Limits of Factuality-Encoding Capabilities in LLMs

Giovanni Servedio, Alessandro De Bellis, Dario Di Palma, Vito Walter Anelli, Tommaso Di Noia

机构 * Politecnico di Bari(巴里理工大学) Sapienza University of Rome(罗马萨皮恩扎大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16491 2025-06-02 cs.CL cs.AI 79%

LLaMAs Have Feelings Too: Unveiling Sentiment and Emotion Representations in LLaMA Models Through Probing

Dario Di Palma, Alessandro De Bellis, Giovanni Servedio, Vito Walter Anelli, Fedelucio Narducci, Tommaso Di Noia

机构 * Politecnico di Bari(巴里理工学院) Sapienza University of Rome(罗马萨皮恩扎大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22993 2025-05-30 cs.CL cs.AI cs.DB cs.IR 79%

Verify-in-the-Graph: Entity Disambiguation Enhancement for Complex Claim Verification with Interactive Graph Representation

Hoang Pham, Thanh-Do Nguyen, Khac-Hoai Nam Bui

机构 * Viettel Artificial Intelligence and Data Services Center(越南 Viettel 人工智能与数据服务中心) Viettel Group(越南 Viettel 集团)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Published at NAACL 2025 Main Conference

Journal ref https://aclanthology.org/2025.naacl-long.268

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21800 2025-05-29 cs.LG cs.CL 79%

From Directions to Cones: Exploring Multidimensional Representations of Propositional Facts in LLMs

Stanley Yu, Vaidehi Bulusu, Oscar Yasunaga, Clayton Lau, Cole Blondin, Sean O'Brien, Kevin Zhu, Vasu Sharma

机构 * Stanley Yu(斯坦利·尤) Vaidehi Bulusu(瓦迪希·布卢苏) Oscar Yasunaga(奥斯卡·亚苏纳加) Clayton Lau(克莱顿·劳) Cole Blondin(科尔·布兰迪恩) Kevin Zhu(凯文·朱) Vasu Sharma(瓦苏·沙玛)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21218 2025-05-28 cs.CL cs.AI 79%

Pretrained LLMs Learn Multiple Types of Uncertainty

Roi Cohen, Omri Fahn, Gerard de Melo

机构 * HPI / University of Potsdam(HPI/波茨坦大学) Tel Aviv University(特拉维夫大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18517 2025-05-27 cs.AI cs.LG cs.SD eess.AS 79%

LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs

Pooneh Mousavi, Shubham Gupta, Cem Subakan, Mirco Ravanelli

机构 * Concordia University(康科迪亚大学) Université Laval(拉瓦尔大学) Mila - Quebec AI Institute(魁北克人工智能研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02605 2025-05-27 cs.CL cs.LG econ.GN q-fin.EC 79%

Interpretable Company Similarity with Sparse Autoencoders

Marco Molinari, Victor Shao, Luca Imeneo, Mateusz Mikolajczak, Vladimir Tregubiak, Abhimanyu Pandey, Sebastian Kuznetsov Ryder Torres Pereira

机构 * London School of Economics(伦敦经济学院) Tower Research Capital(塔罗研究资本)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17511 2025-05-26 cs.MA cs.AI cs.ET cs.LG 79%

Multi-agent Systems for Misinformation Lifecycle : Detection, Correction And Source Identification

Aditya Gautam

机构 * Aditya Gautam

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17327 2025-05-26 cs.CL cs.IT cs.LG math.IT 79%

GPT Editors, Not Authors: The Stylistic Footprint of LLMs in Academic Preprints

Soren DeHaan, Yuanze Liu, Johan Bollen, Sa'ul A. Blanco

机构 * Department of Computer Science(计算机科学系) Indiana University Bloomington(印第安纳大学布卢明顿分校) Cognitive Science Program(认知科学项目) Department of Informatics(信息学系)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15524 2025-05-22 cs.CL cs.AI 79%

Evaluate Bias without Manual Test Sets: A Concept Representation Perspective for LLMs

Lang Gao, Kaiyang Wan, Wei Liu, Chenxi Wang, Zirui Song, Zixiang Xu, Yanbo Wang, Veselin Stoyanov, Xiuying Chen

机构 * MBZUAI Huazhong University of Science and Technology(华中科技大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13989 2025-05-22 cs.LG cs.AI 79%

When LLMs meet open-world graph learning: a new perspective for unlabeled data uncertainty

Yanzhe Wen, Xunkai Li, Qi Zhang, Zhu Lei, Guang Zeng, Rong-Hua Li, Guoren Wang

机构 * Department of Computer Science and Technology(计算机科学与技术系) Beijing Institude of Technology(北京理工大学) Ant Group(蚂蚁集团)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.13489 2025-05-21 cs.AI cs.CL 79%

Contrastive Cross-Course Knowledge Tracing via Concept Graph Guided Knowledge Transfer

Wenkang Han, Wang Lin, Liya Hu, Zhenlong Dai, Yiyun Zhou, Mengze Li, Zemin Liu, Chang Yao, Jingyuan Chen

机构 * Zhejiang University(浙江大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08971 2025-05-15 cs.CV cs.CL cs.LG 79%

Prioritizing Image-Related Tokens Enhances Vision-Language Pre-Training

Yangyi Chen, Hao Peng, Tong Zhang, Heng Ji

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments The code will be available at https://github.com/Yangyi-Chen/PRIOR

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01921 2025-05-13 cs.CL cs.AI 79%

NCL-UoR at SemEval-2025 Task 3: Detecting Multilingual Hallucination and Related Observable Overgeneration Text Spans with Modified RefChecker and Modified SeflCheckGPT

Jiaying Hong, Thanet Markchom, Jianfei Xu, Tong Wu, Huizhi Liang

机构 * School of Computing, Newcastle University(新萨勒姆大学计算机学院) Department of Computer Science, University of Reading(阅读大学计算机科学系) Previously at School of Computing, Newcastle University(新萨勒姆大学计算机学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03788 2025-05-08 cs.CL cs.AI cs.CV 79%

Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding

Trilok Padhi, Ramneet Kaur, Adam D. Cobb, Manoj Acharya, Anirban Roy, Colin Samplawski, Brian Matejek, Alexander M. Berenbeim, Nathaniel D. Bastian, Susmit Jha

机构 * Georgia State University(佐治亚州立大学) Computer Science Lab, SRI(SRI计算机科学实验室) Army Cyber Institute, United States Military Academy(美国陆军网络学院)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12229 2025-04-17 cs.LG cs.CL cs.CR 79%

Watermarking Needs Input Repetition Masking

David Khachaturov, Robert Mullins, Ilia Shumailov, Sumanth Dathathri

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10168 2025-04-15 cs.CL cs.AI 79%

HalluSearch at SemEval-2025 Task 3: A Search-Enhanced RAG Pipeline for Hallucination Detection

Mohamed A. Abdallah, Samhaa R. El-Beltagy

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09482 2025-04-15 cs.CL cs.AI cs.ET 79%

HalluShift: Measuring Distribution Shifts towards Hallucination Detection in LLMs

Sharanya Dasgupta, Sujoy Nath, Arkaprabha Basu, Pourya Shamsolmoali, Swagatam Das

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07069 2025-04-10 cs.CL cs.AI 79%

HalluciNot: Hallucination Detection Through Context and Common Knowledge Verification

Bibek Paudel, Alexander Lyzhov, Preetam Joshi, Puneet Anand

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏