arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 140189 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2407.11504 2024-07-17 cs.IR 67%

Bootstrapped Pre-training with Dynamic Identifier Prediction for Generative Retrieval

Yubao Tang, Ruqing Zhang, Jiafeng Guo, Maarten de Rijke, Yixing Fan, Xueqi Cheng

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Accepted by ACL Findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08323 2024-07-12 cs.CY 67%

Leveraging GPT for the Generation of Multi-Platform Social Media Datasets for Research

Henry Tari, Danial Khan, Justus Rutten, Darian Othman, Rishabh Kaushal, Thales Bertaglia, Adriana Iamnitchi

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05795 2024-07-10 cs.CV 67%

HyCIR: Boosting Zero-Shot Composed Image Retrieval with Synthetic Labels

Yingying Jiang, Hanchao Jia, Xiaobing Wang, Peng Hao

专题命中 预训练与数据 :LLM(abstract);language model(abstract)

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.17880 2024-06-27 cs.CV 67%

MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval

Weitong Cai, Jiabo Huang, Shaogang Gong, Hailin Jin, Yang Liu

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15556 2024-06-25 cs.CV 67%

Open-Vocabulary Temporal Action Localization using Multimodal Guidance

Akshita Gupta, Aditya Arora, Sanath Narayan, Salman Khan, Fahad Shahbaz Khan, Graham W. Taylor

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09471 2024-06-21 physics.geo-ph 67%

Nowcasting Earthquakes with QuakeGPT: Methods and First Results

John B. Rundle, Geoffrey Fox, Andrea Donnellan, Lisa Grant Ludwig

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments 25 Pages, 10 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06751 2024-06-06 cs.CL cs.AI cs.LG 67%

The Unreasonable Effectiveness of Easy Training Data for Hard Tasks

Peter Hase, Mohit Bansal, Peter Clark, Sarah Wiegreffe

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ACL 2024. 23 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.00480 2024-06-04 cs.CV 67%

AlignSAM: Aligning Segment Anything Model to Open Context via Reinforcement Learning

Duojun Huang, Xinyu Xiong, Jie Ma, Jichang Li, Zequn Jie, Lin Ma, Guanbin Li

专题命中 预训练与数据 :foundation model(abstract);prompting(abstract)

Comments CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19283 2024-05-30 cs.CV 67%

Programmable Motion Generation for Open-Set Motion Control Tasks

Hanchao Liu, Xiaohang Zhan, Shaoli Huang, Tai-Jiang Mu, Ying Shan

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments Accepted by CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11639 2024-05-29 cs.LG cs.AI cs.CL 67%

In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness

Liam Collins, Advait Parulekar, Aryan Mokhtari, Sujay Sanghavi, Sanjay Shakkottai

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18137 2024-05-27 cs.RO cs.AI cs.CL cs.CV cs.LG 67%

DecisionNCE: Embodied Multimodal Representations via Implicit Preference Learning

Jianxiong Li, Jinliang Zheng, Yinan Zheng, Liyuan Mao, Xiao Hu, Sijie Cheng, Haoyi Niu, Jihao Liu, Yu Liu, Jingjing Liu, Ya-Qin Zhang, Xianyuan Zhan

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06636 2024-05-24 cs.CV cs.AI cs.CL cs.LG 67%

Federated Document Visual Question Answering: A Pilot Study

Khanh Nguyen, Dimosthenis Karatzas

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04853 2024-05-24 cs.IR 67%

Leveraging LLMs for Unsupervised Dense Retriever Ranking

Ekaterina Khramtsova, Shengyao Zhuang, Mahsa Baktashmotlagh, Guido Zuccon

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments SIGIR2024 full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.09683 2024-05-24 cs.CV 67%

Scaling Open-Vocabulary Object Detection

Matthias Minderer, Alexey Gritsenko, Neil Houlsby

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12250 2024-05-22 cs.LG cs.AI cs.CL 67%

Your Transformer is Secretly Linear

Anton Razzhigaev, Matvey Mikhalchuk, Elizaveta Goncharova, Nikolai Gerasimenko, Ivan Oseledets, Denis Dimitrov, Andrey Kuznetsov

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 9 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01560 2024-05-06 cs.SE cs.CY 67%

Copyright related risks in the creation and use of ML/AI systems

Daniel M. German

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01122 2024-05-03 cs.IR 67%

Generative Relevance Feedback and Convergence of Adaptive Re-Ranking: University of Glasgow Terrier Team at TREC DL 2023

Andrew Parry, Thomas Jaenich, Sean MacAvaney, Iadh Ounis

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments 5 pages, 5 figures, TREC Deep Learning 2023 Notebook

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08832 2024-04-26 cs.CV 67%

Contrasting Intra-Modal and Ranking Cross-Modal Hard Negatives to Enhance Visio-Linguistic Compositional Understanding

Le Zhang, Rabiul Awal, Aishwarya Agrawal

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16030 2024-04-25 cs.CV cs.AI cs.CL cs.LG 67%

MoDE: CLIP Data Experts via Clustering

Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments IEEE CVPR 2024 Camera Ready. Code Link: https://github.com/facebookresearch/MetaCLIP/tree/main/mode

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.03895 2024-04-18 cs.CL cs.AI cs.LG 67%

IDIAPers @ Causal News Corpus 2022: Efficient Causal Relation Identification Through a Prompt-based Few-shot Approach

Sergio Burdisso, Juan Zuluaga-Gomez, Esau Villatoro-Tello, Martin Fajcik, Muskaan Singh, Pavel Smrz, Petr Motlicek

专题命中 预训练与数据 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments To be published in CASE@EMNLP 2022 (5th Workshop on Challenges and Applications of Automated Extraction of Socio-political Events from Text)

Journal ref CASE @ EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08836 2024-04-16 cs.CL cs.AI cs.LG 67%

BERT-LSH: Reducing Absolute Compute For Attention

Zezheng Li, Kingston Yip

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.08506 2024-04-15 cs.CV 67%

LaSagnA: Language-based Segmentation Assistant for Complex Queries

Cong Wei, Haoxian Tan, Yujie Zhong, Yujiu Yang, Lin Ma

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10908 2024-04-11 cs.CV 67%

CLOVA: A Closed-Loop Visual Assistant with Tool Usage and Update

Zhi Gao, Yuntao Du, Xintong Zhang, Xiaojian Ma, Wenjuan Han, Song-Chun Zhu, Qing Li

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03144 2024-04-05 cs.CV 67%

Diverse and Tailored Image Generation for Zero-shot Multi-label Classification

Kaixin Zhang, Zhixiang Yuan, Tao Huang

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02583 2024-04-04 cs.SE 67%

Generative Software Engineering

Yuan Huang, Yinan Chen, Xiangping Chen, Junqi Chen, Rui Peng, Zhicao Tang, Jinbo Huang, Furen Xu, Zibin Zheng

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.02560 2024-04-01 cs.CV 67%

VicTR: Video-conditioned Text Representations for Activity Recognition

Kumara Kahatapitiya, Anurag Arnab, Arsha Nagrani, Michael S. Ryoo

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments To appear at CVPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00869 2024-03-27 cs.CV 67%

Segment and Caption Anything

Xiaoke Huang, Jianfeng Wang, Yansong Tang, Zheng Zhang, Han Hu, Jiwen Lu, Lijuan Wang, Zicheng Liu

专题命中 预训练与数据 :language model(abstract);pretraining(abstract)

Comments The project page, along with the associated code, can be accessed via https://xk-huang.github.io/segment-caption-anything/; Update author information; Accepted by CVPR 24

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10417 2024-03-27 cs.CV 67%

SINC: Spatial Composition of 3D Human Motions for Simultaneous Action Generation

Nikos Athanasiou, Mathis Petrovich, Michael J. Black, Gül Varol

专题命中 预训练与数据 :language model(abstract);prompting(abstract)

Comments Teaser Fixed

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09113 2024-03-19 cs.CL cs.AI cs.LG 67%

AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning

Ruiyi Zhang, Rushi Qiang, Sai Ashish Somayajula, Pengtao Xie

专题命中 预训练与数据 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00390 2024-03-19 cs.CV 67%

InstructCV: Instruction-Tuned Text-to-Image Diffusion Models as Vision Generalists

Yulu Gan, Sungwoo Park, Alexander Schubert, Anthony Philippakis, Ahmed M. Alaa

专题命中 预训练与数据 :large language model(abstract);language model(abstract)

Comments ICLR 2024; Code is available at https://github.com/AlaaLab/InstructCV

详情

展开后加载摘要…

URL PDF HTML 收藏