arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12429 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2410.06967 2024-10-10 cs.CR cs.CY 78%

$\texttt{ModSCAN}$: Measuring Stereotypical Bias in Large Vision-Language Models from Vision and Language Modalities

Yukun Jiang, Zheng Li, Xinyue Shen, Yugeng Liu, Michael Backes, Yang Zhang

专题命中 预训练与数据 :language model(title,abstract)

Comments Accepted in EMNLP 2024. 29 pages, 22 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04426 2024-10-08 cs.CV 78%

CoVLM: Leveraging Consensus from Vision-Language Models for Semi-supervised Multi-modal Fake News Detection

Devank, Jayateja Kalla, Soma Biswas

专题命中 预训练与数据 :language model(title,abstract)

Comments Accepted in ACCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08787 2024-09-27 cs.CV 78%

Data Adaptive Traceback for Vision-Language Foundation Models in Image Classification

Wenshuo Peng, Kaipeng Zhang, Yue Yang, Hao Zhang, Yu Qiao

专题命中 预训练与数据 :foundation model(title,abstract)

Comments 9 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06770 2024-09-17 cs.RO 78%

Pretraining-finetuning Framework for Efficient Co-design: A Case Study on Quadruped Robot Parkour

Ci Chen, Jiyu Yu, Haojian Lu, Hongbo Gao, Rong Xiong, Yue Wang

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.08251 2024-09-13 cs.CV 78%

Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding

Hongyu Li, Tianrui Hui, Zihan Ding, Jing Zhang, Bin Ma, Xiaoming Wei, Jizhong Han, Si Liu

专题命中 预训练与数据 :prompting(title);pretraining(abstract)

Comments Accepted by ACM MM 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10726 2024-09-12 cs.CV cs.RO 78%

Few-Shot Panoptic Segmentation With Foundation Models

Markus Käppeler, Kürsat Petek, Niclas Vödisch, Wolfram Burgard, Abhinav Valada

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted for "IEEE International Conference on Robotics and Automation (ICRA) 2024"

Journal ref IEEE International Conference on Robotics and Automation, 2024, pp. 7718-7724

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07644 2024-09-10 cs.AI cs.CL cs.LG 78%

Toward Understanding BERT-Like Pre-Training for DNA Foundation Models

Chaoqi Liang, Lifeng Qiao, Peng Ye, Nanqing Dong, Jianle Sun, Weiqiang Bai, Yuchen Ren, Xinzhu Ma, Hongliang Yan, Chunfeng Song, Wanli Ouyang, Wangmeng Zuo

专题命中 预训练与数据 :foundation model(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.03230 2024-09-06 cs.RO physics.flu-dyn 78%

Improving agent performance in fluid environments by perceptual pretraining

Jin Zhang, Jianyang Xue, Bochao Cao

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02885 2024-09-05 eess.IV cs.CV 78%

CanvOI, an Oncology Intelligence Foundation Model: Scaling FLOPS Differently

Jonathan Zalach, Inbal Gazy, Assaf Avinoam, Ron Sinai, Eran Shmuel, Inbar Gilboa, Christine Swisher, Naim Matasci, Reva Basho, David B. Agus

专题命中 预训练与数据 :foundation model(title,abstract)

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.02101 2024-09-04 cs.CV cs.MM 78%

Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language Models

Jiaqi Xu, Mengyang Wu, Xiaowei Hu, Chi-Wing Fu, Qi Dou, Pheng-Ann Heng

专题命中 预训练与数据 :language model(title,abstract)

Comments Accepted by ECCV 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.17154 2024-09-02 cs.CV 78%

Self-supervised Anomaly Detection Pretraining Enhances Long-tail ECG Diagnosis

Aofan Jiang, Chaoqin Huang, Qing Cao, Yuchen Xu, Zi Zeng, Kang Chen, Ya Zhang, Yanfeng Wang

专题命中 预训练与数据 :pretraining(title,abstract)

Comments arXiv admin note: text overlap with arXiv:2404.04935

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20495 2024-08-29 eess.IV cs.CV 78%

Enhancing Quantitative Image Synthesis through Pretraining and Resolution Scaling for Bone Mineral Density Estimation from a Plain X-ray Image

Yi Gu, Yoshito Otake, Keisuke Uemura, Masaki Takao, Mazen Soufi, Seiji Okada, Nobuhiko Sugano, Hugues Talbot, Yoshinobu Sato

专题命中 预训练与数据 :pretraining(title,abstract)

Comments SASHIMI, 2024 (MICCAI workshop). 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13385 2024-08-27 cs.CV 78%

MICM: Rethinking Unsupervised Pretraining for Enhanced Few-shot Learning

Zhenyu Zhang, Guangyao Chen, Yixiong Zou, Zhimeng Huang, Yuhua Li, Ruixuan Li

专题命中 预训练与数据 :pretraining(title,abstract)

Comments ACMMM 2024 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11641 2024-08-26 cs.CV 78%

Arc2Face: A Foundation Model for ID-Consistent Human Faces

Foivos Paraperas Papantoniou, Alexandros Lattas, Stylianos Moschoglou, Jiankang Deng, Bernhard Kainz, Stefanos Zafeiriou

专题命中 预训练与数据 :foundation model(title,abstract)

Comments ECCV 2024 (Oral), 29 pages, 20 figures. Project page: https://arc2face.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.17419 2024-08-22 cs.CV 78%

AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors

You-Ming Chang, Chen Yeh, Wei-Chen Chiu, Ning Yu

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11000 2024-08-21 cs.CV 78%

SenPa-MAE: Sensor Parameter Aware Masked Autoencoder for Multi-Satellite Self-Supervised Pretraining

Jonathan Prexl, Michael Schmitt

专题命中 预训练与数据 :pretraining(title);foundation model(abstract)

Comments GCPR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09343 2024-08-20 hep-ex physics.data-an 78%

Large-Scale Pretraining and Finetuning for Efficient Jet Classification in Particle Physics

Zihan Zhao, Farouk Mokhtar, Raghav Kansal, Haoyang Li, Javier Duarte

专题命中 预训练与数据 :pretraining(title,abstract)

Comments ACAT 2024 Proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07465 2024-07-18 cs.CV 78%

Exploring the Untouched Sweeps for Conflict-Aware 3D Segmentation Pretraining

Tianfang Sun, Zhizhong Zhang, Xin Tan, Yanyun Qu, Yuan Xie

专题命中 预训练与数据 :pretraining(title,abstract)

Comments preprint, version 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08875 2024-07-17 cs.CV 78%

Advancing Human Action Recognition with Foundation Models trained on Unlabeled Public Videos

Yang Qian, Yinan Sun, Ali Kargarandehkordi, Parnian Azizian, Onur Cezmi Mutlu, Saimourya Surabhi, Pingyi Chen, Zain Jabbar, Dennis Paul Wall, Peter Washington

专题命中 预训练与数据 :foundation model(title,abstract)

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.06084 2024-07-09 cs.CV 78%

3D Vision and Language Pretraining with Large-Scale Synthetic Data

Dejie Yang, Zhu Xu, Wentao Mo, Qingchao Chen, Siyuan Huang, Yang Liu

专题命中 预训练与数据 :pretraining(title,abstract)

Comments accepted by IJCAI2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.15697 2024-07-09 cs.CV 78%

Aligned Unsupervised Pretraining of Object Detectors with Self-training

Ioannis Maniadis Metaxas, Adrian Bulat, Ioannis Patras, Brais Martinez, Georgios Tzimiropoulos

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.08336 2024-06-25 cs.SD cs.CV eess.AS 78%

CoLM-DSR: Leveraging Neural Codec Language Modeling for Multi-Modal Dysarthric Speech Reconstruction

Xueyuan Chen, Dongchao Yang, Dingdong Wang, Xixin Wu, Zhiyong Wu, Helen Meng

专题命中 预训练与数据 :language model(title,abstract)

Comments Accepted by Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11019 2024-06-18 cs.CV 78%

Self-supervised Pretraining and Finetuning for Monocular Depth and Visual Odometry

Boris Chidlovskii, Leonid Antsfeld

专题命中 预训练与数据 :pretraining(title,abstract)

Comments 8 pages, to appear in ICRA'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07537 2024-06-12 cs.CV 78%

Autoregressive Pretraining with Mamba in Vision

Sucheng Ren, Xianhang Li, Haoqin Tu, Feng Wang, Fangxun Shu, Lei Zhang, Jieru Mei, Linjie Yang, Peng Wang, Heng Wang, Alan Yuille, Cihang Xie

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16164 2024-06-11 cs.CV 78%

Task Specific Pretraining with Noisy Labels for Remote Sensing Image Segmentation

Chenying Liu, Conrad M Albrecht, Yi Wang, Xiao Xiang Zhu

专题命中 预训练与数据 :pretraining(title,abstract)

Comments To appear as a conference paper at IEEE IGARSS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07527 2024-05-29 cs.CV 78%

One for All: Toward Unified Foundation Models for Earth Vision

Zhitong Xiong, Yi Wang, Fahong Zhang, Xiao Xiang Zhu

专题命中 预训练与数据 :foundation model(title,abstract)

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00206 2024-05-24 cs.CV 78%

MaskLRF: Self-supervised Pretraining via Masked Autoencoding of Local Reference Frames for Rotation-invariant 3D Point Set Analysis

Takahiko Furuya

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Accepted to the IEEE Access journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.12018 2024-05-22 cs.CV 78%

GEM: Boost Simple Network for Glass Surface Segmentation via Vision Foundation Models

Jing Hao, Moyun Liu, Jinrong Yang, Kuo Feng Hung

专题命中 预训练与数据 :foundation model(title,abstract)

Comments 12 pages, 8 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12018 2024-05-21 cs.CV 78%

Continuous Sign Language Recognition with Adapted Conformer via Unsupervised Pretraining

Neena Aloysius, Geetha M, Prema Nedungadi

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.06911 2024-04-30 cs.CV 78%

3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud Pretraining

Siming Yan, Yuqi Yang, Yuxiao Guo, Hao Pan, Peng-shuai Wang, Xin Tong, Yang Liu, Qixing Huang

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Published in ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏