arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 7596 信号源:cs.CL, cs.AI, cs.LG

1. 知识编辑与模型理解 7596 篇

2112.07924 2022-08-02 cs.CL 57%

Knowledge-Grounded Dialogue Generation with a Unified Knowledge Representation

Yu Li, Baolin Peng, Yelong Shen, Yi Mao, Lars Liden, Zhou Yu, Jianfeng Gao

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted to NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.13703 2022-07-29 cs.SD cs.LG eess.AS 57%

SoundChoice: Grapheme-to-Phoneme Models with Semantic Disambiguation

Artem Ploujnikov, Mirco Ravanelli

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

Comments 5 pages, submitted to INTERSPEECH 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2207.00560 2022-07-04 cs.CL 57%

Is neural language acquisition similar to natural? A chronological probing study

Ekaterina Voloshina, Oleg Serikov, Tatiana Shavrina

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Published in proceedings of Dialogue-2022 "Computational Linguistics and Intellectual Technologies"

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.15010 2022-07-01 cs.CL 57%

"Diversity and Uncertainty in Moderation" are the Key to Data Selection for Multilingual Few-shot Transfer

Shanu Kumar, Sandipan Dandapat, Monojit Choudhury

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.01236 2022-06-29 astro-ph.EP astro-ph.IM cs.LG 57%

Convolutional neural networks as an alternative to Bayesian retrievals

Francisco Ardevol Martinez, Michiel Min, Inga Kamp, Paul I. Palmer

专题命中 知识编辑与模型理解 :prompting(abstract);分类 cs.LG

Comments Accepted for publication in A&A

Journal ref A&A 662, A108 (2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.11255 2022-06-24 q-bio.QM cs.LG 57%

Attention-aware contrastive learning for predicting T cell receptor-antigen binding specificity

Yiming Fang, Xuejun Liu, Hui Liu

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.08222 2022-06-17 cs.CV cs.LG 57%

Adapting Self-Supervised Vision Transformers by Probing Attention-Conditioned Masking Consistency

Viraj Prabhu, Sriram Yenamandra, Aaditya Singh, Judy Hoffman

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.03127 2022-06-09 cs.CL 57%

Rare Tokens Degenerate All Tokens: Improving Neural Text Generation via Adaptive Gradient Gating for Rare Token Embeddings

Sangwon Yu, Jongyoon Song, Heeseung Kim, Seong-min Lee, Woo-Jong Ryu, Sungroh Yoon

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments ACL 2022 Main Conference Camera-Ready Version

Journal ref Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (ACL), Dublin, Ireland, May 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.02608 2022-06-07 cs.CL 57%

What do tokens know about their characters and how do they know it?

Ayush Kaushal, Kyle Mahowald

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.05895 2022-05-31 cs.LG cs.CV stat.ML 57%

Probing Few-Shot Generalization with Attributes

Mengye Ren, Eleni Triantafillou, Kuan-Chieh Wang, James Lucas, Jake Snell, Xaq Pitkow, Andreas S. Tolias, Richard Zemel

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

Comments Technical report, 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.14252 2022-05-31 cs.CL 57%

Self-supervised models of audio effectively explain human cortical responses to speech

Aditya R. Vaidya, Shailee Jain, Alexander G. Huth

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted to the International Conference on Machine Learning (ICML) 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.12416 2022-05-26 cs.CL 57%

Counterfactual Data Augmentation improves Factuality of Abstractive Summarization

Dheeraj Rajagopal, Siamak Shakeri, Cicero Nogueira dos Santos, Eduard Hovy, Chung-Ching Chang

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.08497 2022-05-18 cs.CL 57%

Feature Aggregation in Zero-Shot Cross-Lingual Transfer Using Multilingual BERT

Beiduo Chen, Wu Guo, Quan Liu, Kun Tao

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted by ICPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.08326 2022-05-10 cs.CL 57%

Is "My Favorite New Movie" My Favorite Movie? Probing the Understanding of Recursive Noun Phrases

Qing Lyu, Hua Zheng, Daoxin Li, Li Zhang, Marianna Apidianaki, Chris Callison-Burch

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.02724 2022-05-06 cs.CL 57%

Implicit N-grams Induced by Recurrence

Xiaobing Sun, Wei Lu

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments 16 pages, 7 figures, accepted by the NAACL 2022 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2012.01685 2022-05-05 cs.LG 57%

Cross-Loss Influence Functions to Explain Deep Network Representations

Andrew Silva, Rohit Chopra, Matthew Gombolay

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2111.04198 2022-04-29 cs.CL 57%

TaCL: Improving BERT Pre-training with Token-aware Contrastive Learning

Yixuan Su, Fangyu Liu, Zaiqiao Meng, Tian Lan, Lei Shu, Ehsan Shareghi, Nigel Collier

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Camera-ready for NAACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.13226 2022-04-29 cs.CV cs.LG 57%

Offline Visual Representation Learning for Embodied Navigation

Karmesh Yadav, Ram Ramrakhya, Arjun Majumdar, Vincent-Pierre Berges, Sachit Kuhar, Dhruv Batra, Alexei Baevski, Oleksandr Maksymets

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

Comments 15 pages, 4 figures, 7 tables and supplementary

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.12753 2022-04-28 cs.CL 57%

A Comprehensive Understanding of Code-mixed Language Semantics using Hierarchical Transformer

Ayan Sengupta, Tharun Suresh, Md Shad Akhtar, Tanmoy Chakraborty

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments 12 pages, 1 figure, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.07789 2022-04-26 cs.CL cs.IR 57%

Contrastive Learning with Hard Negative Entities for Entity Set Expansion

Yinghui Li, Yangning Li, Yuxin He, Tianyu Yu, Ying Shen, Hai-Tao Zheng

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted by SIGIR 2022 (Full Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.10298 2022-04-22 cs.CL 57%

DiffCSE: Difference-based Contrastive Learning for Sentence Embeddings

Yung-Sung Chuang, Rumen Dangovski, Hongyin Luo, Yang Zhang, Shiyu Chang, Marin Soljačić, Shang-Wen Li, Wen-tau Yih, Yoon Kim, James Glass

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments NAACL 2022 main conference (Long paper). Pretrained models and code are available at https://github.com/voidism/DiffCSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.07359 2022-04-18 cs.CL 57%

Text Revision by On-the-Fly Representation Optimization

Jingjing Li, Zichao Li, Tao Ge, Irwin King, Michael R. Lyu

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments AAAI 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.14507 2022-04-05 cs.CL 57%

ANNA: Enhanced Language Representation for Question Answering

Changwook Jun, Hansol Jang, Myoseop Sim, Hyun Kim, Jooyoung Choi, Kyungkoo Min, Kyunghoon Bae

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments 11 pages, 3 figures

Journal ref ACL 2022 Workshop RepL4NLP Submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.05837 2022-04-05 cs.CV cs.LG 57%

When Does Contrastive Visual Representation Learning Work?

Elijah Cole, Xuan Yang, Kimberly Wilber, Oisin Mac Aodha, Serge Belongie

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

Comments CVPR 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.16781 2022-04-01 cs.CL 57%

Misogynistic Meme Detection using Early Fusion Model with Graph Network

Harshvardhan Srivastava

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2110.08851 2022-03-30 cs.LG cs.CV 57%

Unsupervised Representation Learning for Binary Networks by Joint Classifier Learning

Dahyun Kim, Jonghyun Choi

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

Comments to appear in CVPR2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.01976 2022-03-24 cs.CL 57%

Overlap-based Vocabulary Generation Improves Cross-lingual Transfer Among Related Languages

Vaidehi Patil, Partha Talukdar, Sunita Sarawagi

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted to appear at the ACL 2022 Main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.12226 2022-03-21 cs.CL 57%

Probing BERT's priors with serial reproduction chains

Takateru Yamakoshi, Thomas L. Griffiths, Robert D. Hawkins

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Findings of ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.03926 2022-03-21 cs.CL 57%

Transformers in the loop: Polarity in neural models of language

Lisa Bylinina, Alexey Tikhonov

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted to ACL 2022 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.09326 2022-03-18 cs.CL 57%

Combining Static and Contextualised Multilingual Embeddings

Katharina Hämmerl, Jindřich Libovický, Alexander Fraser

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

Comments Accepted to Findings of ACL 2022

详情

展开后加载摘要…

URL PDF HTML 收藏