arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7565 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7565 篇

2410.13274 2024-10-18 cs.CL 70%

Breaking Chains: Unraveling the Links in Multi-Hop Knowledge Unlearning

Minseok Choi, ChaeHun Park, Dohyun Lee, Jaegul Choo

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10408 2024-10-15 cs.CL cs.IR 70%

Medico: Towards Hallucination Detection and Correction with Multi-source Evidence Fusion

Xinping Zhao, Jindi Yu, Zhenyu Liu, Jifang Wang, Dongfang Li, Yibin Chen, Baotian Hu, Min Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 12 pages, 3 figures, 6 tables. Accepted by EMNLP 2024's demo track

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.05997 2024-10-10 eess.AS cs.CV cs.LG cs.SD 70%

An Eye for an Ear: Zero-shot Audio Description Leveraging an Image Captioner using Audiovisual Distribution Alignment

Hugo Malard, Michel Olvera, Stéphane Lathuiliere, Slim Essid

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18533 2024-10-07 cs.AI cs.HC 70%

Evaluating Readability and Faithfulness of Concept-based Explanations

Meng Li, Haoran Jin, Ruixuan Huang, Zhihao Xu, Defu Lian, Zijia Lin, Di Zhang, Xiting Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments EMNLP 2024; code: https://github.com/hr-jin/Concept-Explanation-Evaluation

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.01079 2024-10-03 cs.CL 70%

Concept Space Alignment in Multilingual LLMs

Qiwei Peng, Anders Søgaard

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18743 2024-09-30 cs.RO cs.AI 70%

OpenObject-NAV: Open-Vocabulary Object-Oriented Navigation Based on Dynamic Carrier-Relationship Scene Graph

Yujie Tang, Meiling Wang, Yinan Deng, Zibo Zheng, Jiagui Zhong, Yufeng Yue

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Project website: https://openobject-nav.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18679 2024-09-30 cs.CL 70%

"Why" Has the Least Side Effect on Model Editing

Tsung-Hsuan Pan, Chung-Chi Chen, Hen-Hsen Huang, Hsin-Hsi Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17255 2024-09-27 cs.CL 70%

MPCODER: Multi-user Personalized Code Generator with Explicit and Implicit Style Representation Learning

Zhenlong Dai, Chang Yao, WenKang Han, Ying Yuan, Zhipeng Gao, Jingyuan Chen

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted by ACL 2024, Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16727 2024-09-26 cs.CL 70%

RoleBreak: Character Hallucination as a Jailbreak Attack in Role-Playing Systems

Yihong Tang, Bo Wang, Xu Wang, Dongming Zhao, Jing Liu, Jijun Zhang, Ruifang He, Yuexian Hou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15806 2024-09-25 cs.AI 70%

CLSP: High-Fidelity Contrastive Language-State Pre-training for Agent State Representation

Fuxian Huang, Qi Zhang, Shaopeng Zhai, Jie Wang, Tianyi Zhang, Haoran Zhang, Ming Zhou, Yu Liu, Yu Qiao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12194 2024-09-23 cs.CL cs.CY 70%

Gender Representation and Bias in Indian Civil Service Mock Interviews

Somonnoy Banerjee, Sujan Dutta, Soumyajit Datta, Ashiqur R. KhudaBukhsh

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.05923 2024-09-11 cs.SE cs.AI 70%

$\mathbb{USCD}$: Improving Code Generation of LLMs by Uncertainty-Aware Selective Contrastive Decoding

Shuai Wang, Liang Ding, Li Shen, Yong Luo, Zheng He, Wei Yu, Dacheng Tao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 13pages,8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.09580 2024-09-05 cs.CL 70%

Exploring Interpretability of Independent Components of Word Embeddings with Automated Word Intruder Test

Tomáš Musil, David Mareček

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Presented at LREC-COLING 2024, cite this version please: https://aclanthology.org/2024.lrec-main.605/

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01232 2024-09-04 cs.CL 70%

THInC: A Theory-Driven Framework for Computational Humor Detection

Victor De Marez, Thomas Winters, Ayla Rigouts Terryn

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Accepted at CREAI 2024 (International Workshop on Artificial Intelligence and Creativity)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01151 2024-09-04 cs.CV cs.LG 70%

Understanding Multimodal Hallucination with Parameter-Free Representation Alignment

Yueqian Wang, Jianxin Liang, Yuxuan Wang, Huishuai Zhang, Dongyan Zhao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15171 2024-08-28 cs.CL 70%

Measuring text summarization factuality using atomic facts entailment metrics in the context of retrieval augmented generation

N. E. Kriman

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14830 2024-08-28 cs.CR cs.CL 70%

PolicyLR: A Logic Representation For Privacy Policies

Ashish Hooda, Rishabh Khandelwal, Prasad Chalasani, Kassem Fawaz, Somesh Jha

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12529 2024-08-27 cs.CL 70%

Crafting the Path: Robust Query Rewriting for Information Retrieval

Ingeol Baek, Jimin Lee, Joonho Yang, Hwanhee Lee

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 3 figures, 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11827 2024-08-23 cs.CL 70%

The Mechanics of Conceptual Interpretation in GPT Models: Interpretative Insights

Nura Aljaafari, Danilo S. Carvalho, André Freitas

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 23 pages, 25 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10086 2024-08-20 cs.AI 70%

ARMADA: Attribute-Based Multimodal Data Augmentation

Xiaomeng Jin, Jeonghwan Kim, Yu Zhou, Kuan-Hao Huang, Te-Lin Wu, Nanyun Peng, Heng Ji

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.14167 2024-08-01 cs.CL 70%

Definition generation for lexical semantic change detection

Mariia Fedorova, Andrey Kutuzov, Yves Scherrer

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Findings of ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.19338 2024-07-31 cs.AI 70%

Semantic Communication Enhanced by Knowledge Graph Representation Learning

Nour Hello, Paolo Di Lorenzo, Emilio Calvanese Strinati

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted for publication at the 25th IEEE International Workshop on Signal Processing Advances in Wireless Communications (SPAWC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18326 2024-07-29 cs.AR cs.AI 70%

Classification-Based Automatic HDL Code Generation Using LLMs

Wenhao Sun, Bing Li, Grace Li Zhang, Xunzhao Yin, Cheng Zhuo, Ulf Schlichtmann

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15352 2024-07-23 cs.CL 70%

MAVEN-Fact: A Large-scale Event Factuality Detection Dataset

Chunyang Li, Hao Peng, Xiaozhi Wang, Yunjia Qi, Lei Hou, Bin Xu, Juanzi Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00169 2024-07-23 eess.AS cs.LG cs.SD 70%

RepCodec: A Speech Representation Codec for Speech Tokenization

Zhichao Huang, Chutong Meng, Tom Ko

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments ACL 2024 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12161 2024-07-18 cs.AI 70%

Interpretability in Action: Exploratory Analysis of VPT, a Minecraft Agent

Karolis Jucys, George Adamopoulos, Mehrab Hamidi, Stephanie Milani, Mohammad Reza Samsami, Artem Zholus, Sonia Joseph, Blake Richards, Irina Rish, Özgür Şimşek

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.AI

Comments Mechanistic Interpretability Workshop at ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08642 2024-07-12 cs.CL 70%

Towards Building Specialized Generalist AI with System 1 and System 2 Fusion

Kaiyan Zhang, Biqing Qi, Bowen Zhou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09971 2024-07-12 cs.CL 70%

Constructing Benchmarks and Interventions for Combating Hallucinations in LLMs

Adi Simhi, Jonathan Herzig, Idan Szpektor, Yonatan Belinkov

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06190 2024-07-11 cs.CV cs.LG cs.RO 70%

4D Contrastive Superflows are Dense 3D Representation Learners

Xiang Xu, Lingdong Kong, Hui Shuai, Wenwei Zhang, Liang Pan, Kai Chen, Ziwei Liu, Qingshan Liu

专题命中 知识编辑与模型理解 :foundation model(abstract);pretraining(abstract);分类 cs.LG

Comments ECCV 2024; 36 pages, 11 figures, 11 tables; Code at https://github.com/Xiangxu-0103/SuperFlow

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05833 2024-07-11 cs.LG stat.ML 70%

A Bias-Variance-Covariance Decomposition of Kernel Scores for Generative Models

Sebastian G. Gruber, Florian Buettner

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments Published at ICML 2024: https://openreview.net/pdf?id=QwgSOwynxD

详情

展开后加载摘要…

URL PDF HTML 收藏