arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7552 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7552 篇

2406.03158 2024-06-06 cs.CL cs.AI 73%

CSS: Contrastive Semantic Similarity for Uncertainty Quantification of LLMs

Shuang Ao, Stefan Rueger, Advaith Siddharthan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments The paper is accepted by The Conference on Uncertainty in Artificial Intelligence (UAI), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.19009 2024-06-06 cs.LG cs.AI 73%

Unified Generation, Reconstruction, and Representation: Generalized Diffusion with Adaptive Latent Encoding-Decoding

Guangyi Liu, Yu Wang, Zeyu Feng, Qiyu Wu, Liping Tang, Yuan Gao, Zhen Li, Shuguang Cui, Julian McAuley, Zichao Yang, Eric P. Xing, Zhiting Hu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments ICML 2024 camera-ready. Code is available at https://github.com/guangyliu/EDDPM

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10987 2024-06-06 cs.CL cs.AI 73%

WilKE: Wise-Layer Knowledge Editor for Lifelong Knowledge Editing

Chenhui Hu, Pengfei Cao, Yubo Chen, Kang Liu, Jun Zhao

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments To be published in ACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.02060 2024-06-05 cs.CL cs.AI 73%

I've got the "Answer"! Interpretation of LLMs Hidden States in Question Answering

Valeriya Goloviznina, Evgeny Kotelnikov

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for NLDB-2024 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16291 2024-06-05 cs.LG cs.CL 73%

Observable Propagation: Uncovering Feature Vectors in Transformers

Jacob Dunefsky, Arman Cohan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments 42 pages, 6 tables, 3 figures. ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09259 2024-06-04 cs.CL cs.AI 73%

SyntaxShap: Syntax-aware Explainability Method for Text Generation

Kenza Amara, Rita Sevastjanova, Mennatallah El-Assady

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08468 2024-05-15 cs.CL cs.AI 73%

Challenges and Opportunities in Text Generation Explainability

Kenza Amara, Rita Sevastjanova, Mennatallah El-Assady

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 5 figures, xAI-2024 Conference, Main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13093 2024-04-23 cs.CL cs.AI 73%

Event-level Knowledge Editing

Hao Peng, Xiaozhi Wang, Chunyang Li, Kaisheng Zeng, Jiangshan Duo, Yixin Cao, Lei Hou, Juanzi Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.11403 2024-04-22 cs.LG cs.CL q-bio.BM 73%

MolTailor: Tailoring Chemical Molecular Representation to Specific Tasks via Text Prompts

Haoqiang Guo, Sendong Zhao, Haochun Wang, Yanrui Du, Bing Qin

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08978 2024-04-18 cs.LG cs.AI 73%

Incremental Residual Concept Bottleneck Models

Chenming Shang, Shiji Zhou, Hengyuan Zhang, Xinzhe Ni, Yujiu Yang, Yuwang Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17269 2024-04-01 cs.CL cs.AI 73%

Conversational Question Answering with Reformulations over Knowledge Graph

Lihui Liu, Blaine Hill, Boxin Du, Fei Wang, Hanghang Tong

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14003 2024-03-22 cs.CV cs.CL cs.LG 73%

Multi-Modal Hallucination Control by Visual Information Grounding

Alessandro Favero, Luca Zancato, Matthew Trager, Siddharth Choudhary, Pramuditha Perera, Alessandro Achille, Ashwin Swaminathan, Stefano Soatto

专题命中 知识编辑与模型理解 :language model(abstract);preference optimization(abstract);分类 cs.CL、cs.LG

Journal ref IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04321 2024-03-15 cs.CV cs.AI cs.CL cs.MM 73%

Discriminative Probing and Tuning for Text-to-Image Generation

Leigang Qu, Wenjie Wang, Yongqi Li, Hanwang Zhang, Liqiang Nie, Tat-Seng Chua

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments CVPR 2024; project page: https://dpt-t2i.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16347 2024-03-08 cs.RO cs.CL cs.LG 73%

Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks

Eleftherios Triantafyllidis, Filippos Christianos, Zhibin Li

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at the International Conference on Robotics and Automation (ICRA), 2024. The manuscript consists of 10 pages and 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16041 2024-03-01 cs.CL cs.LG 73%

Detecting Machine-Generated Texts by Multi-Population Aware Optimization for Maximum Mean Discrepancy

Shuhai Zhang, Yiliao Song, Jiahao Yang, Yuanqing Li, Bo Han, Mingkui Tan

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments Accepted at ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13462 2024-02-22 cs.CL cs.AI 73%

Potential and Challenges of Model Editing for Social Debiasing

Jianhao Yan, Futing Wang, Yafu Li, Yue Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07321 2024-02-14 cs.LG cs.CL 73%

Summing Up the Facts: Additive Mechanisms Behind Factual Recall in LLMs

Bilal Chughtai, Alan Cooney, Neel Nanda

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

Comments NeurIPS 2023 Attributing Model Behaviour at Scale Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08694 2024-02-01 cs.CL cs.AI 73%

Combining Confidence Elicitation and Sample-based Methods for Uncertainty Quantification in Misinformation Mitigation

Mauricio Rivera, Jean-François Godbout, Reihaneh Rabbany, Kellin Pelrine

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 12 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12947 2024-01-24 cs.CL cs.AI cs.FL cs.LO cs.PL 73%

Transformer-Based Models Are Not Yet Perfect At Learning to Emulate Structural Recursion

Dylan Zhang, Curt Tigges, Zory Zhang, Stella Biderman, Maxim Raginsky, Talia Ringer

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments arXiv admin note: text overlap with arXiv:2305.14699

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06792 2024-01-18 cs.CL cs.AI 73%

LightHouse: A Survey of AGI Hallucination

Feng Wang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08358 2024-01-17 cs.CL cs.AI 73%

Hallucination Detection and Hallucination Mitigation: An Investigation

Junliang Luo, Tianyu Li, Di Wu, Michael Jenkin, Steve Liu, Gregory Dudek

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06796 2024-01-17 cs.CL cs.AI 73%

AI Hallucinations: A Misnomer Worth Clarifying

Negar Maleki, Balaji Padmanabhan, Kaushik Dutta

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.08604 2024-01-17 cs.CL cs.AI 73%

NormSAGE: Multi-Lingual Multi-Cultural Norm Discovery from Conversations On-the-Fly

Yi R. Fung, Tuhin Chakraborty, Hao Guo, Owen Rambow, Smaranda Muresan, Heng Ji

专题命中 知识编辑与模型理解 :language model(abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.11456 2024-01-15 cs.AI cs.LG cs.MA nlin.AO physics.soc-ph 73%

Generative Agent-Based Modeling: Unveiling Social System Dynamics through Coupling Mechanistic Models with Generative Artificial Intelligence

Navid Ghaffarzadegan, Aritra Majumdar, Ross Williams, Niyousha Hosseinichimeh

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments System Dynamics Review (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.03190 2024-01-09 cs.CL cs.AI cs.CV 73%

MPN: Leveraging Multilingual Patch Neuron for Cross-lingual Model Editing

Nianwen Si, Hao Zhang, Weiqiang Zhang

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14504 2024-01-05 cs.CL cs.LG 73%

Theory of Hallucinations based on Equivariance

Hisaichi Shibata

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01364 2024-01-04 q-bio.NC cs.AI cs.LG cs.NE 73%

Multi-Modal Cognitive Maps based on Neural Networks trained on Successor Representations

Paul Stoewer, Achim Schilling, Andreas Maier, Patrick Krauss

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.01197 2024-01-03 cs.CL cs.AI 73%

Uncertainty Resolution in Misinformation Detection

Yury Orlovskiy, Camille Thibault, Anne Imouza, Jean-François Godbout, Reihaneh Rabbany, Kellin Pelrine

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07550 2023-12-14 cs.CV cs.CL cs.CR cs.LG 73%

Understanding (Un)Intended Memorization in Text-to-Image Generative Models

Ali Naseh, Jaechul Roh, Amir Houmansadr

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17793 2023-12-12 cs.CL cs.AI 73%

"You Are An Expert Linguistic Annotator": Limits of LLMs as Analyzers of Abstract Meaning Representation

Allyson Ettinger, Jena D. Hwang, Valentina Pyatkin, Chandra Bhagavatula, Yejin Choi

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 Findings (short)

详情

展开后加载摘要…

URL PDF HTML 收藏