arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 138791 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12393 篇

2503.14304 2025-03-19 eess.IV cs.CV 78%

RoMedFormer: A Rotary-Embedding Transformer Foundation Model for 3D Genito-Pelvic Structure Segmentation in MRI and CT

Yuheng Li, Mingzhe Hu, Richard L. J. Qiu, Maria Thor, Andre Williams, Deborah Marshall, Xiaofeng Yang

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20256 2025-03-13 cs.CV 78%

Do computer vision foundation models learn the low-level characteristics of the human visual system?

Yancheng Cai, Fei Yin, Dounia Hammou, Rafal Mantiuk

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07514 2025-03-12 cs.CV 78%

CNN-JEPA: Self-Supervised Pretraining Convolutional Neural Networks Using Joint Embedding Predictive Architecture

András Kalapos, Bálint Gyires-Tóth

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Preprint

Journal ref 2024 International Conference on Machine Learning and Applications (ICMLA), Miami, FL, USA, 2024, pp. 1111-1114

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16512 2025-03-11 cs.CV 78%

TIPS: Text-Image Pretraining with Spatial awareness

Kevis-Kokitsi Maninis, Kaifeng Chen, Soham Ghosh, Arjun Karpur, Koert Chen, Ye Xia, Bingyi Cao, Daniel Salz, Guangxing Han, Jan Dlabal, Dan Gnanapragasam, Mojtaba Seyedhosseini, Howard Zhou, Andre Araujo

专题命中 预训练与数据 :pretraining(title,abstract)

Comments ICLR2025 camera-ready + appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17860 2025-02-28 cs.CV 78%

UniGS: Unified Language-Image-3D Pretraining with Gaussian Splatting

Haoyuan Li, Yanpeng Zhou, Tao Tang, Jifei Song, Yihan Zeng, Michael Kampffmeyer, Hang Xu, Xiaodan Liang

专题命中 预训练与数据 :pretraining(title);language model(abstract)

Comments ICLR 2025; Corrected citation of Uni3D;

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13883 2025-02-20 cs.CV 78%

Multi-view Video-Pose Pretraining for Operating Room Surgical Activity Recognition

Idris Hamoud, Vinkle Srivastav, Muhammad Abdullah Jamal, Didier Mutter, Omid Mohareri, Nicolas Padoy

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10472 2025-02-20 cs.SE 78%

Towards Semantic Versioning of Open Pre-trained Language Model Releases on Hugging Face

Adekunle Ajibode, Abdul Ali Bangash, Filipe Roseiro Cogo, Bram Adams, Ahmed E. Hassan

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10862 2025-02-18 cs.RO 78%

Accelerated co-design of robots through morphological pretraining

Luke Strgar, Sam Kriegman

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09662 2025-02-17 q-bio.QM cs.CV eess.IV 78%

Generalizable Cervical Cancer Screening via Large-scale Pretraining and Test-Time Adaptation

Hao Jiang, Cheng Jin, Huangjing Lin, Yanning Zhou, Xi Wang, Jiabo Ma, Li Ding, Jun Hou, Runsheng Liu, Zhizhong Chai, Luyang Luo, Huijuan Shi, Yinling Qian, Qiong Wang, Changzhong Li, Anjia Han, Ronald Cheong Kin Chan, Hao Chen

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06881 2025-02-12 q-bio.BM 78%

A Comprehensive Review of Protein Language Models

Lei Wang, Xudong Li, Han Zhang, Jinyi Wang, Dingkang Jiang, Zhidong Xue, Yan Wang

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23831 2025-02-10 cs.CV 78%

FRoundation: Are Foundation Models Ready for Face Recognition?

Tahar Chettaoui, Naser Damer, Fadi Boutros

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted at Image and Vision Computing Journal 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13786 2025-01-29 eess.AS cs.SD 78%

SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor

Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li

专题命中 预训练与数据 :language model(title,abstract)

Comments Accepted by AAAI2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12652 2025-01-28 math.NA cs.NA 78%

PDEformer: Towards a Foundation Model for One-Dimensional Partial Differential Equations

Zhanhong Ye, Xiang Huang, Leheng Chen, Hongsheng Liu, Zidong Wang, Bin Dong

专题命中 预训练与数据 :foundation model(title);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10080 2025-01-20 cs.CV 78%

Few-shot Structure-Informed Machinery Part Segmentation with Foundation Models and Graph Neural Networks

Michael Schwingshackl, Fabio Francisco Oberweger, Markus Murschitz

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted at Winter Conference on Applications of Computer Vision (WACV) 2025. Code and available at https://github.com/AIT-Assistive-Autonomous-Systems/Hopomop

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.08118 2025-01-15 cs.CV 78%

Revisiting Birds Eye View Perception Models with Frozen Foundation Models: DINOv2 and Metric3Dv2

Seamie Hayes, Ganesh Sistu, Ciarán Eising

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted for publication at the Electronic Imaging - Autonomous Vehicles and Machines Connference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02188 2025-01-15 cs.CV 78%

Digi2Real: Bridging the Realism Gap in Synthetic Data Face Recognition via Foundation Models

Anjith George, Sebastien Marcel

专题命中 预训练与数据 :foundation model(title,abstract)

Comments The dataset would be available here: https://www.idiap.ch/paper/digi2real Accepted for Publication in WACV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.00947 2025-01-09 cs.CV 78%

FreeZe: Training-free zero-shot 6D pose estimation with geometric and vision foundation models

Andrea Caraffa, Davide Boscaini, Amir Hamza, Fabio Poiesi

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted to ECCV 2024. Project page: https://andreacaraffa.github.io/freeze

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02892 2025-01-07 cs.CV 78%

FoundPAD: Foundation Models Reloaded for Face Presentation Attack Detection

Guray Ozgur, Eduarda Caldeira, Tahar Chettaoui, Fadi Boutros, Raghavendra Ramachandra, Naser Damer

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted at WACV 2025 workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18832 2024-12-30 eess.AS cs.SD 78%

Structured Speaker-Deficiency Adaptation of Foundation Models for Dysarthric and Elderly Speech Recognition

Shujie Hu, Xurong Xie, Mengzhe Geng, Jiajun Deng, Zengrui Jin, Tianzi Wang, Mingyu Cui, Guinan Li, Zhaoqing Li, Helen Meng, Xunying Liu

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10730 2024-12-17 cs.CV 78%

MAL: Cluster-Masked and Multi-Task Pretraining for Enhanced xLSTM Vision Performance

Wenjun Huang, Jianguo Hu

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10029 2024-12-16 cs.CV 78%

Enhancing Fine-Grained Vision-Language Pretraining with Negative Augmented Samples

Yeyuan Wang, Dehong Gao, Lei Yi, Linbo Jin, Jinxia Zhang, Libin Yang, Xiaoyan Cai

专题命中 预训练与数据 :pretraining(title,abstract)

Comments 15pages, Accepted by AAAI2025, full paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05274 2024-12-09 cs.CV 78%

SimC3D: A Simple Contrastive 3D Pretraining Framework Using RGB Images

Jiahua Dong, Tong Wu, Rui Qian, Jiaqi Wang

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03629 2024-12-09 eess.IV cs.CV q-bio.QM 78%

DiffuPT: Class Imbalance Mitigation for Glaucoma Detection via Diffusion Based Generation and Model Pretraining

Youssof Nawar, Nouran Soliman, Moustafa Wassel, Mohamed ElHabebe, Noha Adly, Marwan Torki, Ahmed Elmassry, Islam Ahmed

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.11502 2024-12-06 cs.CL cs.AI cs.LG 78%

Labrador: Exploring the Limits of Masked Language Modeling for Laboratory Data

David R. Bellamy, Bhawesh Kumar, Cindy Wang, Andrew Beam

专题命中 预训练与数据 :language model(title);分类 cs.CL、cs.AI、cs.LG

Comments 26 pages, 8 figures, best paper award at ML4H 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01427 2024-12-03 cs.CV 78%

FoundIR: Unleashing Million-scale Training Data to Advance Foundation Models for Image Restoration

Hao Li, Xiang Chen, Jiangxin Dong, Jinhui Tang, Jinshan Pan

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Project website: https://www.foundir.net

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.00811 2024-12-03 cs.CV 78%

Vid-Morp: Video Moment Retrieval Pretraining from Unlabeled Videos in the Wild

Peijun Bao, Chenqi Kong, Zihao Shao, Boon Poh Ng, Meng Hwa Er, Alex C. Kot

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15421 2024-11-28 cs.CV 78%

OphCLIP: Hierarchical Retrieval-Augmented Learning for Ophthalmic Surgical Video-Language Pretraining

Ming Hu, Kun Yuan, Yaling Shen, Feilong Tang, Xiaohao Xu, Lin Zhou, Wei Li, Ying Chen, Zhongxing Xu, Zelin Peng, Siyuan Yan, Vinkle Srivastav, Diping Song, Tianbin Li, Danli Shi, Jin Ye, Nicolas Padoy, Nassir Navab, Junjun He, Zongyuan Ge

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00210 2024-11-27 cs.RO 78%

VLM-Social-Nav: Socially Aware Robot Navigation through Scoring using Vision-Language Models

Daeun Song, Jing Liang, Amirreza Payandeh, Amir Hossain Raj, Xuesu Xiao, Dinesh Manocha

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10403 2024-11-18 eess.IV cs.CV 78%

On the Foundation Model for Cardiac MRI Reconstruction

Chi Zhang, Michael Loecher, Cagan Alkan, Mahmut Yurt, Shreyas S. Vasanawala, Daniel B. Ennis

专题命中 预训练与数据 :foundation model(title,abstract)

Comments For MICCAI CMRxRecon Challenge 2024 team CardiAxs

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19596 2024-11-13 cs.CV 78%

LocCa: Visual Pretraining with Location-aware Captioners

Bo Wan, Michael Tschannen, Yongqin Xian, Filip Pavetic, Ibrahim Alabdulmohsin, Xiao Wang, André Susano Pinto, Andreas Steiner, Lucas Beyer, Xiaohua Zhai

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏