arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2506.12481 2025-06-17 cs.CV cs.LG cs.SD eess.AS 70%

Exploring Audio Cues for Enhanced Test-Time Video Model Adaptation

Runhao Zeng, Qi Deng, Ronghao Zhang, Shuaicheng Niu, Jian Chen, Xiping Hu, Victor C. M. Leung

机构 * Artificial Intelligence Research Institute, Shenzhen MSU-BIT University and Guangdong-Hong Kong-Macao Joint Laboratory for Emotional Intelligence and Pervasive Computing(人工智能研究院、深圳MSU-BIT大学及粤港澳大湾区情感智能与普适计算联合实验室) School of Software Engineering, South China University of Technology(华南理工大学软件学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11417 2025-06-16 cs.CV cs.AI 70%

Stop learning it all to mitigate visual hallucination, Focus on the hallucination target

Dokyoon Yoon, Youngsook Song, Woomyong Park

机构 * SIONIC AI

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to CVPR 2025

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10800 2025-06-13 cs.CL 70%

Mitigating Negative Interference in Multilingual Sequential Knowledge Editing through Null-Space Constraints

Wei Sun, Tingyu Qu, Mingxiao Li, Jesse Davis, Marie-Francine Moens

机构 * Department of Computer Science, KU Leuven(计算机科学系,根特大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10641 2025-06-13 cs.CL 70%

Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters

Tatsuya Hiraoka, Kentaro Inui

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) RIKEN(日本研究机构)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.03338 2025-06-13 cs.CL 70%

BabyLM's First Words: Word Segmentation as a Phonological Probing Task

Zébulon Goriely, Paula Buttery

机构 * Department of Computer Science & Technology, University of Cambridge, U.K.(计算机科学与技术系,剑桥大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to CoNLL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13949 2025-06-11 cs.CL cs.CV 70%

Cracking the Code of Hallucination in LVLMs with Vision-aware Head Divergence

Jinghan He, Kuan Zhu, Haiyun Guo, Junfeng Fang, Zhenglin Hua, Yuheng Jia, Ming Tang, Tat-Seng Chua, Jinqiao Wang

机构 * Foundation Model Research Center, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所基础模型研究中心) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) National University of Singapore(新加坡国立大学) Southeast University(东南大学) Wuhan AI Research(武汉人工智能研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06729 2025-06-10 cs.CV cs.CL 70%

Mitigating Object Hallucination via Robust Local Perception Search

Zixian Gao, Chao Yang, Zhanhui Zhou, Xing Xu, Chaochao Lu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Center for Future Media & School of Computer Science and Engineering, University of Electronic Science and Technology of China(未来媒体中心及电子科技大学计算机科学与工程学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04250 2025-06-06 cs.LG 70%

SafeSteer: Interpretable Safety Steering with Refusal-Evasion in LLMs

Shaona Ghosh, Amrita Bhattacharjee, Yftah Ziser, Christopher Parisien

机构 * NVIDIA(英伟达) School of Computing and AI(计算与人工智能学院) Arizona State University(亚利桑那州立大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments arXiv admin note: text overlap with arXiv:2410.01174

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03994 2025-06-05 cs.CL cs.CV 70%

Seeing What Tastes Good: Revisiting Multimodal Distributional Semantics in the Billion Parameter Era

Dan Oneata, Desmond Elliott, Stella Frank

机构 * politehnica Bucharest(布加勒斯特理工大学) Pioneer Center for AI(先锋人工智能中心) Department of Computer Science, University of Copenhagen(哥本哈根大学计算机科学系)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.CL

Comments ACL Findings 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15358 2025-06-05 cs.CL cs.CV 70%

SemEval-2025 Task 1: AdMIRe -- Advancing Multimodal Idiomaticity Representation

Thomas Pickard, Aline Villavicencio, Maggie Mi, Wei He, Dylan Phelps, Marco Idiart

机构 * University of Sheffield, UK(谢菲尔德大学) University of Exeter, UK(埃克塞特大学) Federal University of Rio Grande do Sul, Brazil(里约格朗德杜斯尔大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Author accepted version; SemEval-2025 proceedings to appear at ACL 2025. This version corrects a typo in the results table

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10515 2025-06-05 cs.CL 70%

Probing LLMs for Multilingual Discourse Generalization Through a Unified Label Set

Florian Eichin, Yang Janet Liu, Barbara Plank, Michael A. Hedderich

机构 * MaiNLP, Center for Information and Language Processing, LMU Munich(MaiNLP、信息与语言处理中心、慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 18 pages, 7 figures, 3 tables, code: https://github.com/mainlp/discourse_probes, camera-ready revision for ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05855 2025-06-05 cs.CL 70%

ConSim: Measuring Concept-Based Explanations' Effectiveness with Automated Simulatability

Antonin Poché, Alon Jacovi, Agustin Martin Picard, Victor Boutin, Fanny Jourdan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Journal ref ACL 2025, Jul 2025, Vienna (Austria), France

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02739 2025-06-04 cs.AI 70%

Why do AI agents communicate in human language?

Pengcheng Zhou, Yinglun Feng, Halimulati Julaiti, Zhongliang Yang

机构 * Beijing University Of Posts and Telecommunications(北京邮电大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01384 2025-06-04 cs.CL 70%

Free-text Rationale Generation under Readability Level Control

Yi-Sheng Hsu, Nils Feldhus, Sherzod Hakimov

机构 * German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心) Computational Linguistics, Department of Linguistics, Universität Potsdam(波茨坦大学语言学系计算语言学部门) Quality and Usability Lab, Technische Universität Berlin(柏林技术大学质量与可用性实验室) BIFOLD – Berlin Institute for the Foundations of Learning and Data(柏林学习与数据基础研究院) Computer Science Institute, Hochschule Ruhr West(鲁尔西部大学计算机科学研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025 Workshop on Generation, Evaluation, and Metrics (GEM^2)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00780 2025-06-03 cs.AI 70%

Do not Abstain! Identify and Solve the Uncertainty

Jingyu Liu, Jingquan Peng, xiaopeng Wu, Xubin Li, Tiezheng Ge, Bo Zheng, Yong Liu

机构 * Gaoling School of Artificial Intelligence Renmin University of China(中国人民大学人工智能学院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24238 2025-06-03 cs.CV cs.LG 70%

MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM

Bowen Dong, Minheng Ni, Zitong Huang, Guanglei Yang, Wangmeng Zuo, Lei Zhang

机构 * Harbin Institute of Technology(哈尔滨工业大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.18359 2025-06-03 cs.CL 70%

Improving Model Factuality with Fine-grained Critique-based Evaluator

Yiqing Xie, Wenxuan Zhou, Pradyot Prakash, Di Jin, Yuning Mao, Quintin Fettes, Arya Talebzadeh, Sinong Wang, Han Fang, Carolyn Rose, Daniel Fried, Hejia Zhang

机构 * Carnegie Mellon University(卡内基梅隆大学) Meta GenAI(Meta 生成式人工智能)

专题命中 知识编辑与模型理解 :LLM(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22630 2025-06-02 cs.CL 70%

Stochastic Chameleons: Irrelevant Context Hallucinations Reveal Class-Based (Mis)Generalization in LLMs

Ziling Cheng, Meng Cao, Marc-Antoine Rondeau, Jackie Chi Kit Cheung

机构 * Mila – Quebec Artificial Intelligence Institute(魁北克人工智能研究所) McGill University(麦吉尔大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ACL 2025 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24129 2025-05-30 cs.CV cs.LG 70%

It's a (Blind) Match! Towards Vision-Language Correspondence without Parallel Data

Dominik Schnaus, Nikita Araslanov, Daniel Cremers

机构 * TU Munich(慕尼黑技术大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.LG

Comments Accepted to CVPR 2025, Project page: https://dominik-schnaus.github.io/itsamatch/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08319 2025-05-30 cs.CL 70%

Enhancing Automated Interpretability with Output-Centric Feature Descriptions

Yoav Gur-Arieh, Roy Mayan, Chen Agassy, Atticus Geiger, Mor Geva

机构 * Blavatnik School of Computer Science and AI(布拉瓦特尼克计算机科学与人工智能学院) Tel Aviv University(特拉维夫大学) Pr(Ai) 2 R Group(Pr(Ai) 2 R集团)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted to ACL 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20546 2025-05-29 cs.CL 70%

Paths Not Taken: Understanding and Mending the Multilingual Factual Recall Pipeline

Meng Lu, Ruochen Zhang, Carsten Eickhoff, Ellie Pavlick

机构 * Brown University(布朗大学) University of Tübingen(图宾根大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.20293 2025-05-27 cs.CL 70%

Enhancing the Comprehensibility of Text Explanations via Unsupervised Concept Discovery

Yifan Sun, Danding Wang, Qiang Sheng, Juan Cao, Jintao Li

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Media Synthesis and Forensics Lab(媒体合成与取证实验室)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12731 2025-05-27 cs.AI 70%

Accelerating Adaptive Retrieval Augmented Generation via Instruction-Driven Representation Reduction of Retrieval Overlaps

Jie Ou, Jinyu Guo, Shuaihong Jiang, Zhaokun Wang, Libo Qin, Shunyu Yao, Wenhong Tian

机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) Central South University(中南大学) Big data and artificial intelligent institute, China Telecom Research Institute(中国电信大数据与人工智能研究院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted at Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10957 2025-05-27 cs.LG 70%

When is Task Vector Provably Effective for Model Editing? A Generalization Analysis of Nonlinear Transformers

Hongkang Li, Yihua Zhang, Shuai Zhang, Meng Wang, Sijia Liu, Pin-Yu Chen

机构 * Rensselaer Polytechnic Institute(拉特格斯理工学院) Michigan State University(密歇根州立大学) New Jersey Institute of Technology(新泽西理工学院) IBM Research(IBM研究院)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Published at ICLR 2025 as an oral paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12221 2025-05-27 cs.CL 70%

On-Policy Self-Alignment with Fine-grained Knowledge Feedback for Hallucination Mitigation

Xueru Wen, Jie Lou, Xinyu Lu, Ji Yuqiu, Xinyan Guan, Yaojie Lu, Hongyu Lin, Ben He, Xianpei Han, Debing Zhang, Le Sun

机构 * Chinese Information Processing Laboratory, Institute of Software, Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所信息处理实验室,北京,中国) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国) Xiaohongshu Inc(小红书公司)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted as ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17477 2025-05-26 cs.LG cs.SD eess.AS 70%

Reverse-Speech-Finder: A Neural Network Backtracking Architecture for Generating Alzheimer's Disease Speech Samples and Improving Diagnosis Performance

Victor OK Li, Yang Han, Jacqueline CK Lam, Lawrence YL Cheung

机构 * The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16894 2025-05-23 cs.CL 70%

Shadows in the Attention: Contextual Perturbation and Representation Drift in the Dynamics of Hallucination in LLMs

Zeyu Wei, Shuo Wang, Xiaohui Rong, Xuemin Liu, He Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15771 2025-05-23 cs.LG 70%

ORION Grounded in Context: Retrieval-Based Method for Hallucination Detection

Assaf Gerner, Netta Madvil, Nadav Barak, Alex Zaikman, Jonatan Liberman, Liron Hamra, Rotem Brazilay, Shay Tsadok, Yaron Friedman, Neal Harow, Noam Bressler, Shir Chorev, Philip Tannor

机构 * Deepchecks

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12788 2025-05-22 cs.CL 70%

Meta-Chunking: Learning Text Segmentation and Semantic Completion via Logical Perception

Jihao Zhao, Zhiyuan Ji, Yuchen Feng, Pengnian Qi, Simin Niu, Bo Tang, Feiyu Xiong, Zhiyu Li

机构 * School of Information, Renmin University of China(中国人民大学信息学院) Institute for Advanced Algorithms Research(高级算法研究所)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14905 2025-05-22 cs.CL 70%

Concept Incongruence: An Exploration of Time and Death in Role Playing

Xiaoyan Bai, Ike Peng, Aditya Singh, Chenhao Tan

机构 * University of Chicago(芝加哥大学)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Our code is available, see https://github.com/ChicagoHAI/concept-incongruence.git

详情

展开后加载摘要…

URL PDF HTML 收藏