arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2502.20984 2025-05-02 cs.CL cs.AI 73%

UoR-NCL at SemEval-2025 Task 1: Using Generative LLMs and CLIP Models for Multilingual Multimodal Idiomaticity Representation

Thanet Markchom, Tong Wu, Liting Huang, Huizhi Liang

机构 * Department of Computer Science, University of Reading(阅读大学计算机科学系) School of Computing, Newcastle University(新castle大学计算机学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.19792 2025-04-29 cs.LG cs.AI stat.ML 73%

Contextures: The Mechanism of Representation Learning

Runtian Zhai

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments PhD Dissertation

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14370 2025-04-22 math.CO cs.CL cs.DM cs.LG 73%

Density Measures for Language Generation

Jon Kleinberg, Fan Wei

机构 * Department of Computer Science and Information Science, Cornell University(计算机科学与信息科学系,康奈尔大学) Department of Mathemaics, Duke University(数学系,杜克大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00509 2025-04-17 cs.CL cs.AI cs.CY 73%

Surveying the Dead Minds: Historical-Psychological Text Analysis with Contextualized Construct Representation (CCR) for Classical Chinese

Yuqi Chen, Sixuan Li, Ying Li, Mohammad Atari

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

Journal ref Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing (EMNLP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08852 2025-04-15 cs.LG cs.AI cs.AR 73%

ML For Hardware Design Interpretability: Challenges and Opportunities

Raymond Baartmans, Andrew Ensinger, Victor Agostinelli, Lizhong Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.18923 2025-04-10 cs.CL cs.AI 73%

EzSQL: An SQL intermediate representation for improving SQL-to-text Generation

Meher Bhardwaj, Hrishikesh Ethari, Dennis Singh Moirangthem

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.AI

Comments Under revision and review at Expert System With Applications Journal after first review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02885 2025-04-09 cs.CV cs.AI cs.LG 73%

Expertized Caption Auto-Enhancement for Video-Text Retrieval

Baoyao Yang, Junxiang Chen, Wanyun Li, Wenbin Yao, Yang Zhou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02540 2025-04-09 cs.LG cs.AI 73%

GraphXAIN: Narratives to Explain Graph Neural Networks

Mateusz Cedro, David Martens

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 19 pages, 9 figures, 2 tables

Journal ref World Conference on Explainable Artificial Intelligence 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04215 2025-04-08 cs.CL cs.AI 73%

Towards Understanding and Improving Refusal in Compressed Models via Mechanistic Interpretability

Vishnu Kabir Chhabra, Mohammad Mahdi Khalili

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02020 2025-04-08 cs.CL cs.AI 73%

Enhancing Uncertainty Modeling with Semantic Graph for Hallucination Detection

Kedi Chen, Qin Chen, Jie Zhou, Xinqi Tao, Bowen Ding, Jingwen Xie, Mingchen Xie, Peilong Li, Feng Zheng, Liang He

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03819 2025-04-04 cs.LG cs.CL cs.CY 73%

LEACE: Perfect linear concept erasure in closed form

Nora Belrose, David Schneider-Joseph, Shauli Ravfogel, Ryan Cotterell, Edward Raff, Stella Biderman

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06816 2025-04-01 cs.AI cs.CL 73%

MAQA: Evaluating Uncertainty Quantification in LLMs Regarding Data Uncertainty

Yongjin Yang, Haneul Yoo, Hwaran Lee

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Findings of NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14582 2025-03-31 cs.AI cs.CL 73%

Do LLMs estimate uncertainty well in instruction-following?

Juyeon Heo, Miao Xiong, Christina Heinze-Deml, Jaya Narain

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14754 2025-03-27 cs.LG cs.AI cs.CV 73%

Bayesian Modeling of Zero-Shot Classifications for Urban Flood Detection

Matt Franchi, Nikhil Garg, Wendy Ju, Emma Pierson

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments In review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19650 2025-03-26 cs.CL cs.AI 73%

HausaNLP at SemEval-2025 Task 3: Towards a Fine-Grained Model-Aware Hallucination Detection

Maryam Bala, Amina Imam Abubakar, Abdulhamid Abubakar, Abdulkadir Shehu Bichi, Hafsa Kabir Ahmad, Sani Abdullahi Sani, Idris Abdulmumin, Shamsuddeen Hassan Muhamad, Ibrahim Said Ahmad

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.09283 2025-03-20 cs.CL cs.AI 73%

DAHRS: Divergence-Aware Hallucination-Remediated SRL Projection

Sangpil Youm, Brodie Mather, Chathuri Jayaweera, Juliana Prada, Bonnie Dorr

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 6 figures, Accepted to The 29th International Conference on Natural Language & Information Systems (NLDB 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19606 2025-03-19 cs.LG cs.CL cs.CV cs.NE 73%

Hyper-Connections

Defa Zhu, Hongzhi Huang, Zihao Huang, Yutao Zeng, Yunyao Mao, Banggu Wu, Qiyang Min, Xun Zhou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.04606 2025-03-18 cs.AI cs.CL 73%

Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation

Chenyu Wang, Weichao Zhou, Shantanu Ghosh, Kayhan Batmanghelich, Wenchao Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01727 2025-03-14 cs.LG cs.CL 73%

Automated Knowledge Concept Annotation and Question Representation Learning for Knowledge Tracing

Yilmazcan Ozyurt, Stefan Feuerriegel, Mrinmaya Sachan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05980 2025-03-11 cs.CL cs.AI 73%

SINdex: Semantic INconsistency Index for Hallucination Detection in LLMs

Samir Abdaljalil, Hasan Kurban, Parichit Sharma, Erchin Serpedin, Rachad Atat

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19593 2025-02-28 cs.LG cs.AI 73%

Improving Representation Learning of Complex Critical Care Data with ICU-BERT

Ricardo Santos, André V. Carreiro, Xi Peng, Hugo Gamboa, Holger Fröhlich

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted for poster at GenAI4Health Workshop at AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15832 2025-02-27 cs.AR cs.CL cs.LG 73%

DeepRTL: Bridging Verilog Understanding and Generation with a Unified Representation Model

Yi Liu, Changran Xu, Yunhao Zhou, Zeju Li, Qiang Xu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments ICLR 2025 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17900 2025-02-26 cs.LG cs.AI 73%

Knowledge-enhanced Multimodal ECG Representation Learning with Arbitrary-Lead Inputs

Che Liu, Cheng Ouyang, Zhongwei Wan, Haozhe Wang, Wenjia Bai, Rossella Arcucci

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15826 2025-02-25 cs.CL cs.AI 73%

CoME: An Unlearning-based Approach to Conflict-free Model Editing

Dahyun Jung, Jaehyung Seo, Jaewook Lee, Chanjun Park, Heuiseok Lim

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to NAACL 2025 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11701 2025-02-24 cs.CL cs.AI cs.CV cs.MM 73%

Magnifier Prompt: Tackling Multimodal Hallucination via Extremely Simple Instructions

Yuhan Fu, Ruobing Xie, Jiazhen Liu, Bangxiang Lan, Xingwu Sun, Zhanhui Kang, Xirong Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The proposed method does not work for up-to-date MLLMs.

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14838 2025-02-21 cs.CL cs.AI 73%

Revealing and Mitigating Over-Attention in Knowledge Editing

Pinzheng Wang, Zecheng Tang, Keyan Zhou, Juntao Li, Qiaoming Zhu, Min Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13430 2025-02-20 cs.AI cs.LG 73%

Vision-Based Generic Potential Function for Policy Alignment in Multi-Agent Reinforcement Learning

Hao Ma, Shijie Wang, Zhiqiang Pu, Siyao Zhao, Xiaolin Ai

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09173 2025-02-17 cs.LG cs.AI 73%

Two-Stage Representation Learning for Analyzing Movement Behavior Dynamics in People Living with Dementia

Jin Cui, Alexander Capstick, Payam Barnaghi, Gregory Scott

专题命中 知识编辑与模型理解 :language model(abstract,comments);large language model(comments,journal_ref);分类 cs.AI、cs.LG

Comments AAAI 2025 Workshop on Large Language Models and Generative AI for Health

Journal ref AAAI 2025 Workshop on Large Language Models and Generative AI for Health

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08059 2025-02-13 cs.CL cs.LG 73%

On Mechanistic Circuits for Extractive Question-Answering

Samyadeep Basu, Vlad Morariu, Zichao Wang, Ryan Rossi, Cherry Zhao, Soheil Feizi, Varun Manjunatha

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05980 2025-02-13 cs.SE cs.AI cs.LG cs.PL 73%

Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates

Ashish Hooda, Mihai Christodorescu, Miltiadis Allamanis, Aaron Wilson, Kassem Fawaz, Somesh Jha

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏