arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7565 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7565 篇

2310.12663 2023-10-20 cs.LG 70%

Knowledge from Uncertainty in Evidential Deep Learning

Cai Davies, Marc Roig Vilamala, Alun D. Preece, Federico Cerutti, Lance M. Kaplan, Supriyo Chakraborty

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11770 2023-10-19 cs.SE cs.AI 70%

Telecom AI Native Systems in the Age of Generative AI -- An Engineering Perspective

Ricardo Britto, Timothy Murphy, Massimo Iovene, Leif Jonsson, Melike Erol-Kantarci, Benedek Kovács

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10673 2023-10-18 cs.CL 70%

Towards Emotion-Based Synthetic Consciousness: Using LLMs to Estimate Emotion Probability Vectors

David Sinclair, Willem Pye

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Emotion descriptors derived from LLMs are likely to be used in governing robot behaviour. Vectorizing emotion descriptors provides a finer grained representation of state than current 'positive vs negative' situation assessments. Finer grained geometric representation of state will be necessary for future human robot interaction governance

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10616 2023-10-17 cs.LG 70%

How Do Transformers Learn In-Context Beyond Simple Functions? A Case Study on Learning with Representations

Tianyu Guo, Wei Hu, Song Mei, Huan Wang, Caiming Xiong, Silvio Savarese, Yu Bai

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05077 2023-10-17 cs.LG stat.ML 70%

Generalization error bounds for iterative learning algorithms with bounded updates

Jingwen Fu, Nanning Zheng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02655 2023-10-05 cs.CR cs.CL 70%

AGIR: Automating Cyber Threat Intelligence Reporting with Natural Language Generation

Filippo Perrina, Francesco Marchiori, Mauro Conti, Nino Vincenzo Verde

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 10 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.13873 2023-09-28 cs.CV cs.AI 70%

Fantasia3D: Disentangling Geometry and Appearance for High-quality Text-to-3D Content Creation

Rui Chen, Yongwei Chen, Ningxin Jiao, Kui Jia

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted by ICCV 2023. Project page: https://fantasia3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.12915 2023-09-19 cs.HC cs.AI 70%

Language as Reality: A Co-Creative Storytelling Game Experience in 1001 Nights using Generative AI

Yuqian Sun, Zhouyi Li, Ke Fang, Chang Hee Lee, Ali Asadipour

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments The paper was accepted by The 19th AAAI Conference on Artificial Intelligence and Interactive Digital Entertainment (AIIDE 23)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.06363 2023-09-13 cs.CL 70%

Learning to Predict Concept Ordering for Common Sense Generation

Tianhui Zhang, Danushka Bollegala, Bei Peng

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11920 2023-08-24 cs.CV cs.AI 70%

Concept Bottleneck with Visual Concept Filtering for Explainable Medical Image Classification

Injae Kim, Jongha Kim, Joonmyung Choi, Hyunwoo J. Kim

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments Accepted to MedAGI Workshop at MICCAI 2023 (Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.08358 2023-08-17 cs.LG stat.ML 70%

Convergence of Two-Layer Regression with Nonlinear Units

Yichuan Deng, Zhao Song, Shenghao Xie

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.13714 2023-07-27 cs.CY cs.CL 70%

Diversity and Language Technology: How Techno-Linguistic Bias Can Cause Epistemic Injustice

Paula Helm, Gábor Bella, Gertraud Koch, Fausto Giunchiglia

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments arXiv admin note: text overlap with arXiv:2307.13405

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.09550 2023-07-19 cs.CL cs.IR cs.IT math.IT 70%

Life of PII -- A PII Obfuscation Transformer

Ajinkya Deshmukh, Saumya Banthia, Anantha Sharma

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.04693 2023-07-11 cs.SE cs.AI 70%

COMEX: A Tool for Generating Customized Source Code Representations

Debeshee Das, Noble Saji Mathews, Alex Mathai, Srikanth Tamilselvam, Kranthi Sedamaki, Sridhar Chimalakonda, Atul Kumar

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

Comments The paper has been accepted for publication at ASE 2023 (Tool Demonstrations Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18185 2023-07-11 cs.CL 70%

Syntax and Semantics Meet in the "Middle": Probing the Syntax-Semantics Interface of LMs Through Agentivity

Lindia Tjuatja, Emmy Liu, Lori Levin, Graham Neubig

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11976 2023-06-22 cs.CL physics.chem-ph q-bio.BM 70%

Interactive Molecular Discovery with Natural Language

Zheni Zeng, Bangchen Yin, Shipeng Wang, Jiarui Liu, Cheng Yang, Haishen Yao, Xingzhi Sun, Maosong Sun, Guotong Xie, Zhiyuan Liu

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.10056 2023-06-21 cs.CL cs.IR 70%

Generate to Understand for Representation

Changshang Xue, Xiande Zhong, Xiaoqing Liu

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08920 2023-06-16 cs.CL cs.SD eess.AS 70%

Pushing the Limits of Unsupervised Unit Discovery for SSL Speech Representation

Ziyang Ma, Zhisheng Zheng, Guanrou Yang, Yu Wang, Chao Zhang, Xie Chen

专题命中 知识编辑与模型理解 :language model(abstract);foundation model(abstract);分类 cs.CL

Comments Accepted to Interspeech 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06340 2023-06-13 eess.SP cs.LG q-bio.QM 70%

ECGBERT: Understanding Hidden Language of ECGs with Self-Supervised Representation Learning

Seokmin Choi, Sajad Mousavi, Phillip Si, Haben G. Yhdego, Fatemeh Khadem, Fatemeh Afghah

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01828 2023-06-06 cs.CV cs.AI 70%

Unifying (Machine) Vision via Counterfactual World Modeling

Daniel M. Bear, Kevin Feigelis, Honglin Chen, Wanhee Lee, Rahul Venkatesh, Klemen Kotar, Alex Durango, Daniel L. K. Yamins

专题命中 知识编辑与模型理解 :foundation model(abstract);prompting(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14630 2023-05-25 cs.CL 70%

Testing Causal Models of Word Meaning in GPT-3 and -4

Sam Musker, Ellie Pavlick

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments Unabridged version. Code available at https://github.com/smusker/Causal_Models_Of_Word_Meaning

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12167 2023-05-23 cs.AI 70%

The Case Against Explainability

Hofit Wasserman Rozen, Niva Elkin-Koren, Ran Gilad-Bachrach

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.00732 2023-05-02 cs.LG cs.SE 70%

R-U-SURE? Uncertainty-Aware Code Suggestions By Maximizing Utility Across Random User Intents

Daniel D. Johnson, Daniel Tarlow, Christian Walder

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments To appear at ICML 2023. 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10346 2023-04-21 cs.CL 70%

Interventional Probing in High Dimensions: An NLI Case Study

Julia Rozanova, Marco Valentino, Lucas Cordeiro, Andre Freitas

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.15621 2023-04-14 cs.CL 70%

ChatGPT as a Factual Inconsistency Evaluator for Text Summarization

Zheheng Luo, Qianqian Xie, Sophia Ananiadou

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments ongoing work, 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.03917 2023-03-07 cs.SD cs.LG eess.AS 70%

Noise2Music: Text-conditioned Music Generation with Diffusion Models

Qingqing Huang, Daniel S. Park, Tao Wang, Timo I. Denk, Andy Ly, Nanxin Chen, Zhengdong Zhang, Zhishuai Zhang, Jiahui Yu, Christian Frank, Jesse Engel, Quoc V. Le, William Chan, Zhifeng Chen, Wei Han

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.LG

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.00281 2022-11-03 cs.CL 70%

Fast-R2D2: A Pretrained Recursive Neural Network based on Pruned CKY for Grammar Induction and Text Representation

Xiang Hu, Haitao Mi, Liang Li, Gerard de Melo

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.CL

Comments EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.02881 2022-10-07 q-bio.QM cs.LG 70%

Antibody Representation Learning for Drug Discovery

Lin Li, Esther Gupta, John Spaeth, Leslie Shing, Tristan Bepler, Rajmonda Sulo Caceres

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.10617 2022-07-22 cs.CL 70%

Leveraging Natural Supervision for Language Representation Learning and Generation

Mingda Chen

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments PhD Thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.05787 2022-05-04 cs.CL 70%

Representation Learning for Conversational Data using Discourse Mutual Information Maximization

Bishal Santra, Sumegh Roychowdhury, Aishik Mandal, Vasu Gurram, Atharva Naik, Manish Gupta, Pawan Goyal

专题命中 知识编辑与模型理解 :language model(abstract);pretraining(abstract);分类 cs.CL

Comments Preprint, 15 pages, To appear in NAACL 2022 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏