arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2403.09369 2024-03-15 cs.NI 67%

PreConfig: A Pretrained Model for Automating Network Configuration

Fuliang Li, Haozhi Lang, Jiajie Zhang, Jiaxing Shen, Xingwei Wang

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08081 2024-03-14 cs.LG cs.AI cs.CL math.OC 67%

Mechanics of Next Token Prediction with Self-Attention

Yingcong Li, Yixiao Huang, M. Emrullah Ildiz, Ankit Singh Rawat, Samet Oymak

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to AISTATS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16338 2024-03-12 cs.CV 67%

BLO-SAM: Bi-level Optimization Based Overfitting-Preventing Finetuning of SAM

Li Zhang, Youwei Liang, Ruiyi Zhang, Amirhosein Javadi, Pengtao Xie

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06072 2024-03-07 cs.SD eess.AS 67%

JVNV: A Corpus of Japanese Emotional Speech with Verbal Content and Nonverbal Expressions

Detai Xin, Junfeng Jiang, Shinnosuke Takamichi, Yuki Saito, Akiko Aizawa, Hiroshi Saruwatari

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12936 2024-03-06 cs.SE 67%

Measuring Impacts of Poisoning on Model Parameters and Neuron Activations: A Case Study of Poisoning CodeBERT

Aftab Hussain, Md Rafiqul Islam Rabin, Navid Ayoobi, Mohammad Amin Alipour

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.02984 2024-02-22 stat.ML cs.AI cs.CL cs.LG cs.NE 67%

Scaling Laws for Associative Memories

Vivien Cabannes, Elvis Dohmatob, Alberto Bietti

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12813 2024-02-21 cs.SE 67%

Scaling Laws Behind Code Understanding Model

Jiayi Lin, Hande Dong, Yutao Xie, Lei Zhang

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12530 2024-02-21 cs.CL cs.AI cs.LG 67%

Parallel Structures in Pre-training Data Yield In-Context Learning

Yanda Chen, Chen Zhao, Zhou Yu, Kathleen McKeown, He He

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.09371 2024-02-15 cs.LG cs.AI cs.CL 67%

Transformers Can Achieve Length Generalization But Not Robustly

Yongchao Zhou, Uri Alon, Xinyun Chen, Xuezhi Wang, Rishabh Agarwal, Denny Zhou

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08802 2024-02-15 cs.IR 67%

Multi-Label Zero-Shot Product Attribute-Value Extraction

Jiaying Gong, Hoda Eldardiry

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments 12 pages, 4 figures, WWW2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08657 2024-02-14 cs.CV 67%

PIN: Positional Insert Unlocks Object Localisation Abilities in VLMs

Michael Dorkenwald, Nimrod Barazani, Cees G. M. Snoek, Yuki M. Asano

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.07664 2024-02-13 econ.GN q-fin.EC 67%

Computer says 'no': Exploring systemic bias in ChatGPT using an audit approach

Louis Lippens

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments 39 pages, 2 tables, 4 figures; for data and supplementary tables, see https://osf.io/vezt7

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.05767 2024-02-08 cs.SD eess.AS 67%

Natural Language Supervision for General-Purpose Audio Representations

Benjamin Elizalde, Soham Deshmukh, Huaming Wang

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04252 2024-02-07 cs.CV 67%

EVA-CLIP-18B: Scaling CLIP to 18 Billion Parameters

Quan Sun, Jinsheng Wang, Qiying Yu, Yufeng Cui, Fan Zhang, Xiaosong Zhang, Xinlong Wang

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03777 2024-02-07 cs.SE 67%

Improving Automated Code Reviews: Learning from Experience

Hong Yi Lin, Patanamon Thongtanunam, Christoph Treude, Wachiraphan Charoenwet

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Accepted by the 21st International Conference on Mining Software Repositories (MSR 24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.07193 2024-02-05 cs.CV 67%

DINOv2: Learning Robust Visual Features without Supervision

Maxime Oquab, Timothée Darcet, Théo Moutakanni, Huy Vo, Marc Szafraniec, Vasil Khalidov, Pierre Fernandez, Daniel Haziza, Francisco Massa, Alaaeldin El-Nouby, Mahmoud Assran, Nicolas Ballas, Wojciech Galuba, Russell Howes, Po-Yao Huang, Shang-Wen Li, Ishan Misra, Michael Rabbat, Vasu Sharma, Gabriel Synnaeve, Hu Xu, Hervé Jegou, Julien Mairal, Patrick Labatut, Armand Joulin, Piotr Bojanowski

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.05673 2024-02-02 cs.CL cs.AI cs.CY cs.LG 67%

BERT in Plutarch's Shadows

Ivan P. Yamshchikov, Alexey Tikhonov, Yorgos Pantis, Charlotte Schubert, Jürgen Jost

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.07575 2024-01-11 cs.SE 67%

What Makes Good In-context Demonstrations for Code Intelligence Tasks with LLMs?

Shuzheng Gao, Xin-Cheng Wen, Cuiyun Gao, Wenxuan Wang, Hongyu Zhang, Michael R. Lyu

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments This paper is accepted by ASE 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00268 2024-01-02 cs.CV 67%

COMMA: Co-Articulated Multi-Modal Learning

Lianyu Hu, Liqing Gao, Zekang Liu, Chi-Man Pun, Wei Feng

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments Accepted to AAAI2024. Code is available at https://github.com/hulianyuyy/COMMA

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18072 2023-12-20 cs.CV 67%

Image Captioning with Multi-Context Synthetic Data

Feipeng Ma, Yizhou Zhou, Fengyun Rao, Yueyi Zhang, Xiaoyan Sun

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Accepted by AAAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09806 2023-12-18 cs.CL cs.AI cs.LG 67%

Improving Biomedical Entity Linking with Retrieval-enhanced Learning

Zhenxi Lin, Ziheng Zhang, Xian Wu, Yefeng Zheng

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICASSP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09251 2023-12-15 cs.CV 67%

VL-GPT: A Generative Pre-trained Transformer for Vision and Language Understanding and Generation

Jinguo Zhu, Xiaohan Ding, Yixiao Ge, Yuying Ge, Sijie Zhao, Hengshuang Zhao, Xiaohua Wang, Ying Shan

专题命中 预训练与数据 :language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09020 2023-12-15 cs.CV 67%

Exploring Transferability for Randomized Smoothing

Kai Qiu, Huishuai Zhang, Zhirong Wu, Stephen Lin

专题命中 预训练与数据 :foundation model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.07435 2023-12-13 cs.CV cs.AI cs.CL cs.LG 67%

Cross-modal Contrastive Learning with Asymmetric Co-attention Network for Video Moment Retrieval

Love Panta, Prashant Shrestha, Brabeem Sapkota, Amrita Bhattarai, Suresh Manandhar, Anand Kumar Sah

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18064 2023-12-01 cs.CV 67%

GELDA: A generative language annotation framework to reveal visual biases in datasets

Krish Kabra, Kathleen M. Lewis, Guha Balakrishnan

专题命中 预训练与数据 :LLM(abstract);language model(abstract)

Comments 21 pages, 15 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17937 2023-12-01 cs.CV 67%

Unlocking Spatial Comprehension in Text-to-Image Diffusion Models

Mohammad Mahdi Derakhshani, Menglin Xia, Harkirat Behl, Cees G. M. Snoek, Victor Rühle

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.18498 2023-12-01 cs.PL cs.AI cs.CL cs.LG 67%

ANPL: Towards Natural Programming with Interactive Decomposition

Di Huang, Ziyuan Nan, Xing Hu, Pengwei Jin, Shaohui Peng, Yuanbo Wen, Rui Zhang, Zidong Du, Qi Guo, Yewen Pu, Yunji Chen

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15075 2023-11-28 cs.CV 67%

Mug-STAN: Adapting Image-Language Pretrained Models for General Video Understanding

Ruyang Liu, Jingjia Huang, Wei Gao, Thomas H. Li, Ge Li

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.07336 2023-11-15 cs.AI cs.CL cs.LG cs.LO 67%

Learning Deductive Reasoning from Synthetic Corpus based on Formal Logic

Terufumi Morishita, Gaku Morio, Atsuki Yamaguchi, Yasuhiro Sogawa

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Journal ref Proceedings of the 40th International Conference on Machine Learning, PMLR 202:25254-25274, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05863 2023-11-13 cs.CR cs.CV 67%

Watermarking Vision-Language Pre-trained Models for Multi-modal Embedding as a Service

Yuanmin Tang, Jing Yu, Keke Gai, Xiangyan Qu, Yue Hu, Gang Xiong, Qi Wu

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏