arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2504.05324 2025-04-09 cs.IR cs.AI cs.CL 90%

Hybrid Retrieval for Hallucination Mitigation in Large Language Models: A Comparative Analysis

Chandana Sree Mala, Gizem Gezici, Fosca Giannotti

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13622 2025-04-09 cs.CL cs.AI 90%

REFIND at SemEval-2025 Task 3: Retrieval-Augmented Factuality Hallucination Detection in Large Language Models

DongGeon Lee, Hwanjo Yu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to SemEval@ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00936 2025-04-09 cs.CL cs.AI 90%

Large Language Model Enhanced Knowledge Representation Learning: A Survey

Xin Wang, Zirui Chen, Haofen Wang, Leong Hou U, Zhao Li, Wenbin Guo

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04238 2025-04-08 cs.CL cs.AI 90%

Sensitivity Meets Sparsity: The Impact of Extremely Sparse Parameter Patterns on Theory-of-Mind of Large Language Models

Yuheng Wu, Wentao Guo, Zirui Liu, Heng Ji, Zhaozhuo Xu, Denghui Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02865 2025-04-07 cs.CL cs.LG 90%

The Illusionist's Prompt: Exposing the Factual Vulnerabilities of Large Language Models with Linguistic Nuances

Yining Wang, Yuquan Wang, Xi Li, Mi Zhang, Geng Hong, Min Yang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11948 2025-03-18 cs.CL cs.AI 90%

Integration of Explainable AI Techniques with Large Language Models for Enhanced Interpretability for Sentiment Analysis

Thivya Thogesan, Anupiya Nugaliyadde, Kok Wai Wong

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15844 2025-03-13 cs.CL cs.LG 90%

Hallucination Detection in Large Language Models with Metamorphic Relations

Borui Yang, Md Afif Al Mamun, Jie M. Zhang, Gias Uddin

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted to the ACM Joint European Software Engineering Conference and Symposium on the Foundations of Software Engineering (ESEC/FSE 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03666 2025-03-06 cs.CL cs.LG 90%

Analogical Reasoning Inside Large Language Models: Concept Vectors and the Limits of Abstraction

Gustaw Opiełka, Hannes Rosenbusch, Claire E. Stevenson

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05316 2025-03-06 cs.LG cs.AI cs.CE q-bio.BM 90%

Aligning Large Language Models and Geometric Deep Models for Protein Representation

Dong Shu, Bingbing Duan, Kai Guo, Kaixiong Zhou, Jiliang Tang, Mengnan Du

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments 37 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18725 2025-02-27 cs.AI cs.CL q-bio.NC 90%

Talking to the brain: Using Large Language Models as Proxies to Model Brain Semantic Representation

Xin Liu, Ziyue Zhang, Jingxin Nie

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16820 2025-02-26 cs.CL cs.AI 90%

Uncertainty Quantification of Large Language Models through Multi-Dimensional Responses

Tiejin Chen, Xiaoou Liu, Longchao Da, Jia Chen, Vagelis Papalexakis, Hua Wei

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08038 2025-02-25 cs.LG cs.CL cs.SI 90%

Bootstrapping Heterogeneous Graph Representation Learning via Large Language Models: A Generalized Approach

Hang Gao, Chenhao Zhang, Fengge Wu, Junsuo Zhao, Changwen Zheng, Huaping Liu

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14845 2025-02-25 cs.LG cs.CL 90%

Understanding the Relationship between Prompts and Response Uncertainty in Large Language Models

Ze Yu Zhang, Arun Verma, Finale Doshi-Velez, Bryan Kian Hsiang Low

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments 22 pages, Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06824 2025-02-24 cs.CL cs.AI 90%

Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective

Tianlong Li, Zhenghua Wang, Wenhao Liu, Muling Wu, Shihan Dou, Changze Lv, Xiaohua Wang, Xiaoqing Zheng, Xuanjing Huang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by COLING 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06257 2025-02-11 cs.CL cs.AI 90%

K-ON: Stacking Knowledge On the Head Layer of Large Language Model

Lingbing Guo, Yichi Zhang, Zhongpu Bo, Zhuo Chen, Mengshu Sun, Zhiqiang Zhang, Wen Zhang, Huajun Chen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments AAAI 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06223 2025-02-07 cs.CL cs.AI 90%

On Effects of Steering Latent Representation for Large Language Model Unlearning

Dang Huu-Tien, Trung-Tin Pham, Hoang Thanh-Tung, Naoya Inoue

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at AAAI-25 Main Technical Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01691 2025-02-05 cs.CL cs.AI 90%

Agent-Based Uncertainty Awareness Improves Automated Radiology Report Labeling with an Open-Source Large Language Model

Hadas Ben-Atya, Naama Gavrielov, Zvi Badash, Gili Focht, Ruth Cytter-Kuint, Talar Hagopian, Dan Turner, Moti Freiman

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.18119 2025-01-31 cs.CL cs.AI 90%

Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models

Qika Lin, Tianzhe Zhao, Kai He, Zhen Peng, Fangzhi Xu, Ling Huang, Jingying Ma, Mengling Feng

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09967 2025-01-20 cs.LG cs.AI cs.CV 90%

Explainable artificial intelligence (XAI): from inherent explainability to large language models

Fuseini Mumuni, Alhassan Mumuni

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10236 2025-01-07 cs.SE cs.AI cs.CL 90%

Look Before You Leap: An Exploratory Study of Uncertainty Measurement for Large Language Models

Yuheng Huang, Jiayang Song, Zhijie Wang, Shengming Zhao, Huaming Chen, Felix Juefei-Xu, Lei Ma

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Update website, code, and experiments on eight new LLMs. To appear in the IEEE Transactions on Software Engineering (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04693 2024-12-20 cs.CL cs.AI 90%

ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models

Yuzhe Gu, Ziwei Ji, Wenwei Zhang, Chengqi Lyu, Dahua Lin, Kai Chen

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2024. Dataset, code, and model are released at https://github.com/open-compass/ANAH

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10257 2024-12-17 cs.CL cs.AI 90%

Targeted Angular Reversal of Weights (TARS) for Knowledge Removal in Large Language Models

Harry J. Davies, Giorgos Iacovides, Danilo P. Mandic

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 5 figures, 1 table. Fixing typo with the final weight editing equation

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09612 2024-12-17 cs.AI cs.LG physics.chem-ph 90%

Automated Molecular Concept Generation and Labeling with Large Language Models

Zimin Zhang, Qianli Wu, Botao Xia, Fang Sun, Ziniu Hu, Yizhou Sun, Shichang Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09563 2024-12-13 cs.LG cs.CL 90%

Does Representation Matter? Exploring Intermediate Layers in Large Language Models

Oscar Skean, Md Rifat Arefin, Yann LeCun, Ravid Shwartz-Ziv

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted to 2024 NeurIPs Workshop on Machine Learning and Compression

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14065 2024-12-11 cs.CL cs.LG 90%

Temporally Consistent Factuality Probing for Large Language Models

Ashutosh Bajpai, Aaryan Goyal, Atif Anwer, Tanmoy Chakraborty

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.07234 2024-11-12 cs.CR cs.AI cs.CL 90%

Goal-guided Generative Prompt Injection Attack on Large Language Models

Chong Zhang, Mingyu Jin, Qinkai Yu, Chengzhi Liu, Haochen Xue, Xiaobo Jin

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 6 figures

Journal ref IEEE International Conference on Data Mining 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05200 2024-11-11 cs.CY cs.CL cs.HC cs.LG 90%

Toward Cultural Interpretability: A Linguistic Anthropological Framework for Describing and Evaluating Large Language Models (LLMs)

Graham M. Jones, Shai Satran, Arvind Satyanarayan

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments Accepted for publication in Big Data & Society, November 2, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14894 2024-11-08 cs.CL cs.AI cs.CY cs.IR physics.soc-ph 90%

Talking the Talk Does Not Entail Walking the Walk: On the Limits of Large Language Models in Lexical Entailment Recognition

Candida M. Greco, Lucio La Cava, Andrea Tagarelli

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at The 2024 Conference on Empirical Methods in Natural Language Processing (EMNLP-2024) - Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02603 2024-11-08 cs.CL cs.AI stat.ML 90%

FactTest: Factuality Testing in Large Language Models with Finite-Sample and Distribution-Free Guarantees

Fan Nie, Xiaotian Hou, Shuhang Lin, James Zou, Huaxiu Yao, Linjun Zhang

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03522 2024-11-07 q-bio.GN cs.AI cs.LG 90%

Exploring the Potentials and Challenges of Using Large Language Models for the Analysis of Transcriptional Regulation of Long Non-coding RNAs

Wei Wang, Zhichao Hou, Xiaorui Liu, Xinxia Peng

专题命中 知识编辑与模型理解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏