arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7583 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7583 篇

2405.16405 2024-11-04 cs.LG cs.AI 79%

Intruding with Words: Towards Understanding Graph Injection Attacks at the Text Level

Runlin Lei, Yuwei Hu, Yuchen Ren, Zhewei Wei

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted by NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14577 2024-11-01 cs.CL cs.LG 79%

Representation Noising: A Defence Mechanism Against Harmful Finetuning

Domenic Rosati, Jan Wehner, Kai Williams, Łukasz Bartoszcze, David Atanasov, Robie Gonzales, Subhabrata Majumdar, Carsten Maple, Hassan Sajjad, Frank Rudzicz

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Published in NeurIPs 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14744 2024-10-22 cs.CL cs.AI 79%

Eliciting Uncertainty in Chain-of-Thought to Mitigate Bias against Forecasting Harmful User Behaviors

Anthony Sicilia, Malihe Alikhani

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17969 2024-10-17 cs.CL cs.AI 79%

Encourage or Inhibit Monosemanticity? Revisit Monosemanticity from a Feature Decorrelation Perspective

Hanqi Yan, Yanzheng Xiang, Guangyi Chen, Yifei Wang, Lin Gui, Yulan He

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI

Comments EMNLP24, Main, Long

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12701 2024-10-16 cs.CL cs.AI 79%

OLAPH: Improving Factuality in Biomedical Long-form Question Answering

Minbyul Jeong, Hyeon Hwang, Chanwoong Yoon, Taewhoo Lee, Jaewoo Kang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03748 2024-10-08 cs.CL cs.LG 79%

Khattat: Enhancing Readability and Concept Representation of Semantic Typography

Ahmed Hussein, Alaa Elsetohy, Sama Hadhoud, Tameem Bakr, Yasser Rohaim, Badr AlKhamissi

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.18727 2024-10-07 cs.CL cs.AI cs.IR 79%

CtrlA: Adaptive Retrieval-Augmented Generation via Inherent Control

Huanshuo Liu, Hao Zhang, Zhijiang Guo, Jing Wang, Kuicai Dong, Xiangyang Li, Yi Quan Lee, Cong Zhang, Yong Liu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 29 pages, 10 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07085 2024-09-12 cs.CL cs.LG 79%

Understanding Knowledge Drift in LLMs through Misinformation

Alina Fastowski, Gjergji Kasneci

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 13 pages, 3 figures. Accepted at DELTA workshop at KDD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16905 2024-08-29 cs.AI cs.LG cs.LO 79%

Procedural Adherence and Interpretability Through Neuro-Symbolic Generative Agents

Raven Rothkopf, Hannah Tongxin Zeng, Mark Santolucito

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10923 2024-08-27 cs.CL cs.AI 79%

LBC: Language-Based-Classifier for Out-Of-Variable Generalization

Kangjun Noh, Baekryun Seong, Hoyoon Byun, Youngjun Choi, Sungjin Song, Kyungwoo Song

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 16 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03623 2024-08-07 cs.CL cs.AI cs.CY 79%

Unveiling LLMs: The Evolution of Latent Representations in a Dynamic Knowledge Graph

Marco Bronzini, Carlo Nicolini, Bruno Lepri, Jacopo Staiano, Andrea Passerini

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at COLM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17468 2024-07-25 cs.CL cs.AI 79%

WildHallucinations: Evaluating Long-form Factuality in LLMs with Real-World Entity Queries

Wenting Zhao, Tanya Goyal, Yu Ying Chiu, Liwei Jiang, Benjamin Newman, Abhilasha Ravichander, Khyathi Chandu, Ronan Le Bras, Claire Cardie, Yuntian Deng, Yejin Choi

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11833 2024-07-17 cs.CL cs.LG 79%

LoFTI: Localization and Factuality Transfer to Indian Locales

Sona Elza Simon, Soumen Kumar Mondal, Abhishek Singhania, Sayambhu Sen, Preethi Jyothi

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11015 2024-07-17 cs.CL cs.AI 79%

Does ChatGPT Have a Mind?

Simon Goldstein, Benjamin A. Levinstein

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.04673 2024-07-04 cs.SD cs.AI cs.LG cs.MM eess.AS 79%

LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPT

Zhihao Du, Jiaming Wang, Qian Chen, Yunfei Chu, Zhifu Gao, Zerui Li, Kai Hu, Xiaohuan Zhou, Jin Xu, Ziyang Ma, Wen Wang, Siqi Zheng, Chang Zhou, Zhijie Yan, Shiliang Zhang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages, work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07735 2024-06-13 cs.CL cs.LG 79%

REAL Sampling: Boosting Factuality and Diversity of Open-Ended Generation via Asymptotic Entropy

Haw-Shiuan Chang, Nanyun Peng, Mohit Bansal, Anil Ramakrishna, Tagyoung Chung

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03947 2024-06-10 cs.LG cs.AI 79%

Weight-based Decomposition: A Case for Bilinear MLPs

Michael T. Pearce, Thomas Dooms, Alice Rigg

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);small language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17703 2024-05-29 cs.LG cs.CL 79%

Mechanistic Interpretability of Binary and Ternary Transformers

Jason Li

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.15848 2024-04-29 cs.CL cs.LG 79%

Detecting Conceptual Abstraction in LLMs

Michaela Regneri, Alhassan Abdelhalim, Sören Laue

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Paper accepted at the LREC-COLING 2024 Conference (Paper ID: 1968) accepted-papers/" target="_blank" rel="noopener">https://lrec-coling-2024.org/list-of-accepted-papers/

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10960 2024-04-18 cs.CL cs.AI 79%

Uncertainty-Based Abstention in LLMs Improves Safety and Reduces Hallucinations

Christian Tomani, Kamalika Chaudhuri, Ivan Evtimov, Daniel Cremers, Mark Ibrahim

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);RLHF(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08170 2024-04-12 cs.LG cs.AI 79%

LLaGA: Large Language and Graph Assistant

Runjin Chen, Tong Zhao, Ajay Jaiswal, Neil Shah, Zhangyang Wang

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09702 2024-04-09 cs.CL cs.AI 79%

Deceptive Semantic Shortcuts on Reasoning Chains: How Far Can Models Go without Hallucination?

Bangzheng Li, Ben Zhou, Fei Wang, Xingyu Fu, Dan Roth, Muhao Chen

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Work accepted by NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19113 2024-03-29 cs.CL cs.AI 79%

FACTOID: FACtual enTailment fOr hallucInation Detection

Vipula Rawte, S. M Towhidul Islam Tonmoy, Krishnav Rajbangshi, Shravani Nag, Aman Chadha, Amit P. Sheth, Amitava Das

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08851 2024-03-15 astro-ph.IM cs.CL cs.CV cs.IR cs.LG 79%

PAPERCLIP: Associating Astronomical Observations and Natural Language with Multi-Modal Models

Siddharth Mishra-Sharma, Yiding Song, Jesse Thaler

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);foundation model(abstract);分类 cs.CL、cs.LG

Comments 17+6 pages, 3+1 figures, 5+2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13641 2024-02-28 cs.CV cs.AI cs.CY cs.LG 79%

How Good is ChatGPT at Face Biometrics? A First Look into Recognition, Soft Biometrics, and Explainability

Ivan DeAndres-Tame, Ruben Tolosana, Ruben Vera-Rodriguez, Aythami Morales, Julian Fierrez, Javier Ortega-Garcia

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Journal ref IEEE Access, February 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15631 2024-02-27 cs.CL cs.AI 79%

Fine-Grained Self-Endorsement Improves Factuality and Reasoning

Ante Wang, Linfeng Song, Baolin Peng, Ye Tian, Lifeng Jin, Haitao Mi, Jinsong Su, Dong Yu

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01769 2024-02-06 cs.CL cs.AI 79%

Redefining "Hallucination" in LLMs: Towards a psychology-informed framework for mitigating misinformation

Elijah Berberette, Jack Hutchins, Amir Sadovnik

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.17839 2024-02-01 cs.CL cs.AI cs.IR 79%

Global-Liar: Factuality of LLMs over Time and Geographic Regions

Shujaat Mirza, Bruno Coelho, Yuyuan Cui, Christina Pöpper, Damon McCoy

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 12 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.16577 2024-01-31 cs.CL cs.AI 79%

LLMs as On-demand Customizable Service

Souvika Sarkar, Mohammad Fakhruddin Babar, Monowar Hasan, Shubhra Kanti Karmaker

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07110 2023-12-13 cs.CL cs.CR cs.LG 79%

LLMs Perform Poorly at Concept Extraction in Cyber-security Research Literature

Maxime Würsch, Andrei Kucharavy, Dimitri Percia David, Alain Mermoud

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 24 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏