arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12429 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2502.10862 2025-02-18 cs.RO 78%

Accelerated co-design of robots through morphological pretraining

Luke Strgar, Sam Kriegman

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09662 2025-02-17 q-bio.QM cs.CV eess.IV 78%

Generalizable Cervical Cancer Screening via Large-scale Pretraining and Test-Time Adaptation

Hao Jiang, Cheng Jin, Huangjing Lin, Yanning Zhou, Xi Wang, Jiabo Ma, Li Ding, Jun Hou, Runsheng Liu, Zhizhong Chai, Luyang Luo, Huijuan Shi, Yinling Qian, Qiong Wang, Changzhong Li, Anjia Han, Ronald Cheong Kin Chan, Hao Chen

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06881 2025-02-12 q-bio.BM 78%

A Comprehensive Review of Protein Language Models

Lei Wang, Xudong Li, Han Zhang, Jinyi Wang, Dingkang Jiang, Zhidong Xue, Yan Wang

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23831 2025-02-10 cs.CV 78%

FRoundation: Are Foundation Models Ready for Face Recognition?

Tahar Chettaoui, Naser Damer, Fadi Boutros

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted at Image and Vision Computing Journal 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13786 2025-01-29 eess.AS cs.SD 78%

SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor

Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li

专题命中 预训练与数据 :language model(title,abstract)

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12652 2025-01-28 math.NA cs.NA 78%

PDEformer: Towards a Foundation Model for One-Dimensional Partial Differential Equations

Zhanhong Ye, Xiang Huang, Leheng Chen, Hongsheng Liu, Zidong Wang, Bin Dong

专题命中 预训练与数据 :foundation model(title);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10080 2025-01-20 cs.CV 78%

Few-shot Structure-Informed Machinery Part Segmentation with Foundation Models and Graph Neural Networks

Michael Schwingshackl, Fabio Francisco Oberweger, Markus Murschitz

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted at Winter Conference on Applications of Computer Vision (WACV) 2025. Code and available at https://github.com/AIT-Assistive-Autonomous-Systems/Hopomop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08118 2025-01-15 cs.CV 78%

Revisiting Birds Eye View Perception Models with Frozen Foundation Models: DINOv2 and Metric3Dv2

Seamie Hayes, Ganesh Sistu, Ciarán Eising

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted for publication at the Electronic Imaging - Autonomous Vehicles and Machines Connference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02188 2025-01-15 cs.CV 78%

Digi2Real: Bridging the Realism Gap in Synthetic Data Face Recognition via Foundation Models

Anjith George, Sebastien Marcel

专题命中 预训练与数据 :foundation model(title,abstract)

Comments The dataset would be available here: https://www.idiap.ch/paper/digi2real Accepted for Publication in WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00947 2025-01-09 cs.CV 78%

FreeZe: Training-free zero-shot 6D pose estimation with geometric and vision foundation models

Andrea Caraffa, Davide Boscaini, Amir Hamza, Fabio Poiesi

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted to ECCV 2024. Project page: https://andreacaraffa.github.io/freeze

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02892 2025-01-07 cs.CV 78%

FoundPAD: Foundation Models Reloaded for Face Presentation Attack Detection

Guray Ozgur, Eduarda Caldeira, Tahar Chettaoui, Fadi Boutros, Raghavendra Ramachandra, Naser Damer

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted at WACV 2025 workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18832 2024-12-30 eess.AS cs.SD 78%

Structured Speaker-Deficiency Adaptation of Foundation Models for Dysarthric and Elderly Speech Recognition

Shujie Hu, Xurong Xie, Mengzhe Geng, Jiajun Deng, Zengrui Jin, Tianzi Wang, Mingyu Cui, Guinan Li, Zhaoqing Li, Helen Meng, Xunying Liu

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10730 2024-12-17 cs.CV 78%

MAL: Cluster-Masked and Multi-Task Pretraining for Enhanced xLSTM Vision Performance

Wenjun Huang, Jianguo Hu

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10029 2024-12-16 cs.CV 78%

Enhancing Fine-Grained Vision-Language Pretraining with Negative Augmented Samples

Yeyuan Wang, Dehong Gao, Lei Yi, Linbo Jin, Jinxia Zhang, Libin Yang, Xiaoyan Cai

专题命中 预训练与数据 :pretraining(title,abstract)

Comments 15pages, Accepted by AAAI2025, full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05274 2024-12-09 cs.CV 78%

SimC3D: A Simple Contrastive 3D Pretraining Framework Using RGB Images

Jiahua Dong, Tong Wu, Rui Qian, Jiaqi Wang

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03629 2024-12-09 eess.IV cs.CV q-bio.QM 78%

DiffuPT: Class Imbalance Mitigation for Glaucoma Detection via Diffusion Based Generation and Model Pretraining

Youssof Nawar, Nouran Soliman, Moustafa Wassel, Mohamed ElHabebe, Noha Adly, Marwan Torki, Ahmed Elmassry, Islam Ahmed

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11502 2024-12-06 cs.CL cs.AI cs.LG 78%

Labrador: Exploring the Limits of Masked Language Modeling for Laboratory Data

David R. Bellamy, Bhawesh Kumar, Cindy Wang, Andrew Beam

专题命中 预训练与数据 :language model(title);分类 cs.CL、cs.AI、cs.LG

Comments 26 pages, 8 figures, best paper award at ML4H 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01427 2024-12-03 cs.CV 78%

FoundIR: Unleashing Million-scale Training Data to Advance Foundation Models for Image Restoration

Hao Li, Xiang Chen, Jiangxin Dong, Jinhui Tang, Jinshan Pan

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Project website: https://www.foundir.net

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00811 2024-12-03 cs.CV 78%

Vid-Morp: Video Moment Retrieval Pretraining from Unlabeled Videos in the Wild

Peijun Bao, Chenqi Kong, Zihao Shao, Boon Poh Ng, Meng Hwa Er, Alex C. Kot

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15421 2024-11-28 cs.CV 78%

OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining

Ming Hu, Kun Yuan, Yaling Shen, Feilong Tang, Xiaohao Xu, Lin Zhou, Wei Li, Ying Chen, Zhongxing Xu, Zelin Peng, Siyuan Yan, Vinkle Srivastav, Diping Song, Tianbin Li, Danli Shi, Jin Ye, Nicolas Padoy, Nassir Navab, Junjun He, Zongyuan Ge

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00210 2024-11-27 cs.RO 78%

VLM-Social-Nav: Socially Aware Robot Navigation through Scoring using Vision-Language Models

Daeun Song, Jing Liang, Amirreza Payandeh, Amir Hossain Raj, Xuesu Xiao, Dinesh Manocha

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10403 2024-11-18 eess.IV cs.CV 78%

On the Foundation Model for Cardiac MRI Reconstruction

Chi Zhang, Michael Loecher, Cagan Alkan, Mahmut Yurt, Shreyas S. Vasanawala, Daniel B. Ennis

专题命中 预训练与数据 :foundation model(title,abstract)

Comments For MICCAI CMRxRecon Challenge 2024 team CardiAxs

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19596 2024-11-13 cs.CV 78%

LocCa: Visual Pretraining with Location-aware Captioners

Bo Wan, Michael Tschannen, Yongqin Xian, Filip Pavetic, Ibrahim Alabdulmohsin, Xiao Wang, André Susano Pinto, Andreas Steiner, Lucas Beyer, Xiaohua Zhai

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12470 2024-11-04 cs.CV eess.IV 78%

HSIGene: A Foundation Model For Hyperspectral Image Generation

Li Pang, Xiangyong Cao, Datao Tang, Shuang Xu, Xueru Bai, Feng Zhou, Deyu Meng

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12911 2024-10-31 stat.ME 78%

Pretraining and the Lasso

Erin Craig, Mert Pilanci, Thomas Le Menestrel, Balasubramanian Narasimhan, Manuel Rivas, Stein-Erik Gullaksen, Roozbeh Dehghannasiri, Julia Salzman, Jonathan Taylor, Robert Tibshirani

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.13756 2024-10-28 cs.CV 78%

Contrastive pretraining for semantic segmentation is robust to noisy positive pairs

Sebastian Gerard, Josephine Sullivan

专题命中 预训练与数据 :pretraining(title,abstract)

Comments This work has been submitted to the IEEE for possible publication. Compared to the previous version, large-scale changes were made to make the paper easier to understand for people less familiar with contrastive learning and to make it easier to follow certain arguments. 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06558 2024-10-22 cs.CV 78%

Deep Correlated Prompting for Visual Recognition with Missing Modalities

Lianyu Hu, Tongkai Shi, Wei Feng, Fanhua Shang, Liang Wan

专题命中 预训练与数据 :prompting(title,abstract)

Comments NeurIPS 2024, add some results

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11834 2024-10-16 cs.RO 78%

Contrastive Touch-to-Touch Pretraining

Samanta Rodriguez, Yiming Dou, William van den Bogert, Miquel Oller, Kevin So, Andrew Owens, Nima Fazeli

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13570 2024-10-16 cs.CV 78%

MetaEarth: A Generative Foundation Model for Global-Scale Remote Sensing Image Generation

Zhiping Yu, Chenyang Liu, Liqin Liu, Zhenwei Shi, Zhengxia Zou

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Project page: https://jiupinjia.github.io/metaearth/

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07133 2024-10-11 cs.CV 78%

EvolveDirector: Approaching Advanced Text-to-Image Generation with Large Vision-Language Models

Rui Zhao, Hangjie Yuan, Yujie Wei, Shiwei Zhang, Yuchao Gu, Lingmin Ran, Xiang Wang, Zhangjie Wu, Junhao Zhang, Yingya Zhang, Mike Zheng Shou

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏