arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12534 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12534 篇

2308.04248 2023-08-09 cs.CL cs.AI 62%

Gloss Alignment Using Word Embeddings

Harry Walsh, Ozge Mercanoglu Sincan, Ben Saunders, Richard Bowden

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments 4 pages, 4 figures, 2023 IEEE International Conference on Acoustics, Speech, and Signal Processing Workshops (ICASSPW)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.01546 2023-08-04 cs.SD cs.AI cs.LG cs.MM eess.AS 62%

MusicLDM: Enhancing Novelty in Text-to-Music Generation Using Beat-Synchronous Mixup Strategies

Ke Chen, Yusong Wu, Haohe Liu, Marianna Nezhurina, Taylor Berg-Kirkpatrick, Shlomo Dubnov

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments 16 pages, 3 figures, 2 tables, demo page: https://musicldm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.00072 2023-08-02 cs.CL cs.AI cs.HC 62%

How User Language Affects Conflict Fatality Estimates in ChatGPT

Daniel Kazenwadel, Christoph V. Steinert

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments †both authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.16609 2023-08-01 cs.CL cs.LG cs.SI 62%

Noisy Self-Training with Data Augmentations for Offensive and Hate Speech Detection Tasks

João A. Leite, Carolina Scarton, Diego F. Silva

专题命中 预训练与数据 :prompting(abstract);分类 cs.CL、cs.LG

Comments Accepted to RANLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08036 2023-07-18 cs.CL cs.AI 62%

A Neural-Symbolic Approach Towards Identifying Grammatically Correct Sentences

Nicos Isaak

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments 10 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.03323 2023-07-18 cs.CV cs.AI cs.CR cs.LG 62%

CleanCLIP: Mitigating Data Poisoning Attacks in Multimodal Contrastive Learning

Hritik Bansal, Nishad Singhi, Yu Yang, Fan Yin, Aditya Grover, Kai-Wei Chang

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments 22 pages. Accepted at ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.07797 2023-07-06 cs.CL cs.AI 62%

Monolingual and Cross-Lingual Knowledge Transfer for Topic Classification

Dmitry Karpov, Mikhail Burtsev

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06354 2023-07-04 cs.LG cs.AI 62%

Less is More: Selective Layer Finetuning with SubTuning

Gal Kaplun, Andrey Gurevich, Tal Swisa, Mazor David, Shai Shalev-Shwartz, Eran Malach

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14514 2023-06-28 cs.CL cs.AI 62%

Data-Driven Approach for Formality-Sensitive Machine Translation: Language-Specific Handling and Synthetic Data Generation

Seugnjun Lee, Hyeonseok Moon, Chanjun Park, Heuiseok Lim

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for Data-centric Machine Learning Research (DMLR) Workshop at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14696 2023-06-27 cs.CL cs.AI 62%

How About Kind of Generating Hedges using End-to-End Neural Models?

Alafate Abulimiti, Chloé Clavel, Justine Cassell

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14040 2023-06-27 cs.CL cs.LG 62%

Weighted Automata Extraction and Explanation of Recurrent Neural Networks for Natural Language Tasks

Zeming Wei, Xiyue Zhang, Yihao Zhang, Meng Sun

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09572 2023-06-19 cs.CL cs.AI 62%

How do different tokenizers perform on downstream tasks in scriptio continua languages?: A case study in Japanese

Takuro Fujii, Koki Shibata, Atsuki Yamaguchi, Terufumi Morishita, Yasuhiro Sogawa

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at ACL SRW 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19395 2023-06-14 cs.CL cs.LG 62%

DyGen: Learning from Noisy Labels via Dynamics-Enhanced Generative Modeling

Yuchen Zhuang, Yue Yu, Lingkai Kong, Xiang Chen, Chao Zhang

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.LG

Comments Accepted by KDD 2023 research track

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.02549 2023-06-14 cs.CL cs.CV cs.LG 62%

FormNetV2: Multimodal Graph Contrastive Learning for Form Document Information Extraction

Chen-Yu Lee, Chun-Liang Li, Hao Zhang, Timothy Dozat, Vincent Perot, Guolong Su, Xiang Zhang, Kihyuk Sohn, Nikolai Glushnev, Renshen Wang, Joshua Ainslie, Shangbang Long, Siyang Qin, Yasuhisa Fujii, Nan Hua, Tomas Pfister

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.06866 2023-06-13 cs.LG cs.AI 62%

Generating Synthetic Datasets by Interpolating along Generalized Geodesics

Jiaojiao Fan, David Alvarez-Melis

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Journal ref Conference on Uncertainty in Artificial Intelligence (UAI) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.07348 2023-06-08 cs.LG cs.AI stat.ML 62%

Cliff-Learning

Tony T. Wang, Igor Zablotchi, Nir Shavit, Jonathan S. Rosenfeld

专题命中 预训练与数据 :foundation model(abstract);分类 cs.AI、cs.LG

Comments 16 pages; v2 updates: improved layout, added acknowledgements

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02790 2023-06-06 cs.CL cs.AI 62%

Exploring the Relationship between Alignment and Cross-lingual Transfer in Multilingual Transformers

Félix Gaschi, Patricio Cerda, Parisa Rastin, Yannick Toussaint

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.00652 2023-06-02 cs.CL cs.AI 62%

Explanation Graph Generation via Generative Pre-training over Synthetic Graphs

Han Cui, Shangzhan Li, Yu Zhang, Qi Shi

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ACL23-Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.02774 2023-06-02 stat.ML cs.AI cs.LG math.ST stat.TH 62%

The SSL Interplay: Augmentations, Inductive Bias, and Generalization

Vivien Cabannes, Bobak T. Kiani, Randall Balestriero, Yann LeCun, Alberto Bietti

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Journal ref Proceedings of the 40 th International Conference on Machine Learning, Honolulu, Hawaii, USA. PMLR 202, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19684 2023-06-01 cs.LG cs.AI stat.ML 62%

End-to-end Training of Deep Boltzmann Machines by Unbiased Contrastive Divergence with Local Mode Initialization

Shohei Taniguchi, Masahiro Suzuki, Yusuke Iwasawa, Yutaka Matsuo

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments Accepted at ICML 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.04143 2023-06-01 cs.LG cs.AI cs.CV stat.ML 62%

Can We Scale Transformers to Predict Parameters of Diverse ImageNet Models?

Boris Knyazev, Doha Hwang, Simon Lacoste-Julien

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments ICML 2023, camera ready (7 tables with extra results added), code and models are at https://github.com/SamsungSAILMontreal/ghn3

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.19256 2023-05-31 cs.LG cs.AI cs.CV cs.IT math.IT 62%

Ambient Diffusion: Learning Clean Distributions from Corrupted Data

Giannis Daras, Kulin Shah, Yuval Dagan, Aravind Gollakota, Alexandros G. Dimakis, Adam Klivans

专题命中 预训练与数据 :foundation model(abstract);分类 cs.AI、cs.LG

Comments 24 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18842 2023-05-31 cs.CL cs.AI cs.CV 62%

Generate then Select: Open-ended Visual Question Answering Guided by World Knowledge

Xingyu Fu, Sheng Zhang, Gukyeong Kwon, Pramuditha Perera, Henghui Zhu, Yuhao Zhang, Alexander Hanbo Li, William Yang Wang, Zhiguo Wang, Vittorio Castelli, Patrick Ng, Dan Roth, Bing Xiang

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17273 2023-05-30 cs.CL cs.AI 62%

Slide, Constrain, Parse, Repeat: Synchronous SlidingWindows for Document AMR Parsing

Sadhana Kumaravel, Tahira Naseem, Ramon Fernandez Astudillo, Radu Florian, Salim Roukos

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.16199 2023-05-29 cs.CL cs.LG 62%

Diversity-Aware Coherence Loss for Improving Neural Topic Models

Raymond Li, Felipe González-Pizarro, Linzi Xing, Gabriel Murray, Giuseppe Carenini

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.LG

Comments Minor Fixes, 11 pages, Camera-Ready for ACL 2023 (Short Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.07426 2023-05-29 cs.LG cs.AI cs.RO 62%

Skill-Based Reinforcement Learning with Intrinsic Reward Matching

Ademi Adeniji, Amber Xie, Pieter Abbeel

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07677 2023-05-26 cs.SD cs.CL cs.LG 62%

Masked Audio Text Encoders are Effective Multi-Modal Rescorers

Jinglun Cai, Monica Sunkara, Xilai Li, Anshu Bhatia, Xiao Pan, Sravan Bodapati

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.15387 2023-05-25 cs.CL cs.AI 62%

Peek Across: Improving Multi-Document Modeling via Cross-Document Question-Answering

Avi Caciularu, Matthew E. Peters, Jacob Goldberger, Ido Dagan, Arman Cohan

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at ACL 2023; camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14717 2023-05-25 cs.CL cs.AI 62%

Exploiting Correlations Between Contexts and Definitions with Multiple Definition Modeling

Linhan Zhang, Qian Chen, Wen Wang, Yuxin Jiang, Bing Li, Wei Wang, Xin Cao

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14384 2023-05-25 cs.LG cs.AI cs.CR cs.CV 62%

Adversarial Nibbler: A Data-Centric Challenge for Improving the Safety of Text-to-Image Models

Alicia Parrish, Hannah Rose Kirk, Jessica Quaye, Charvi Rastogi, Max Bartolo, Oana Inel, Juan Ciro, Rafael Mosquera, Addison Howard, Will Cukierski, D. Sculley, Vijay Janapa Reddi, Lora Aroyo

专题命中 预训练与数据 :pretraining(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏