arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12486 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12486 篇

2503.22357 2025-03-31 cs.CV 71%

EchoFlow: A Foundation Model for Cardiac Ultrasound Image and Video Generation

Hadrien Reynaud, Alberto Gomez, Paul Leeson, Qingjie Meng, Bernhard Kainz

机构 * Imperial College London(帝国理工学院) University of Birmingham(伯明翰大学) Ultromics Ltd.(奥特罗米克斯有限公司) University of Oxford(牛津大学) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡弗里德里希-亚历山大大学)

专题命中 预训练与数据 :foundation model(title)

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15639 2025-03-14 cs.RO 71%

Low Fidelity Visuo-Tactile Pretraining Improves Vision-Only Manipulation Performance

Selam Gano, Abraham George, Amir Barati Farimani

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00412 2025-03-12 cs.CV 71%

TROI: Cross-Subject Pretraining with Sparse Voxel Selection for Enhanced fMRI Visual Decoding

Ziyu Wang, Tengyu Pan, Zhenyu Li, Ji Wu, Xiuxing Li, Jianyong Wang

机构 * Tsinghua University(清华大学) Beijing Institute of Technology(北京理工大学) Beihang University(北京航空航天大学)

专题命中 预训练与数据 :pretraining(title)

Comments ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.03752 2025-03-07 cs.CY 71%

Multimodal Generative AI and Foundation Models for Behavioural Health in Online Gambling

Konrad Samsel, Mohammad Noaeen, Neil Seeman, Karim Keshavjee, Li-Jia Li, Zahra Shakeri

专题命中 预训练与数据 :foundation model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04896 2025-02-11 cs.CV 71%

Goku: Flow Based Video Generative Foundation Models

Shoufa Chen, Chongjian Ge, Yuqi Zhang, Yida Zhang, Fengda Zhu, Hao Yang, Hongxiang Hao, Hui Wu, Zhichao Lai, Yifei Hu, Ting-Che Lin, Shilong Zhang, Fu Li, Chuan Li, Xing Wang, Yanghua Peng, Peize Sun, Ping Luo, Yi Jiang, Zehuan Yuan, Bingyue Peng, Xiaobing Liu

机构 * The University of Hong Kong(香港大学) Bytedance Inc(字节跳动公司)

专题命中 预训练与数据 :foundation model(title)

Comments Demo: https://saiyan-world.github.io/goku/

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.06660 2025-01-14 cs.CV cs.RO 71%

MapGS: Generalizable Pretraining and Data Augmentation for Online Mapping via Novel View Synthesis

Hengyuan Zhang, David Paz, Yuliang Guo, Xinyu Huang, Henrik I. Christensen, Liu Ren

机构 * Contextual Robotics Institute, UC San Diego(加州大学圣地亚哥分校情境机器人研究所) Bosch North America(北美博世公司)

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.03491 2024-11-07 cs.CV 71%

An Application-Agnostic Automatic Target Recognition System Using Vision Language Models

Anthony Palladino, Dana Gajewski, Abigail Aronica, Patryk Deptula, Alexander Hamme, Seiyoung C. Lee, Jeff Muri, Todd Nelling, Michael A. Riley, Brian Wong, Margaret Duff

专题命中 预训练与数据 :language model(title)

Comments Accepted to the Thirty-Seventh Annual Conference on Innovative Applications of Artificial Intelligence (IAAI-25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18147 2024-10-25 cs.CV 71%

SSP-RACL: Classification of Noisy Fundus Images with Self-Supervised Pretraining and Robust Adaptive Credal Loss

Mengwen Ye, Yingzi Huangfu, You Li, Zekuan Yu

专题命中 预训练与数据 :pretraining(title)

Comments IEEE BioCAS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15745 2024-09-25 eess.IV cs.CV 71%

ManiNeg: Manifestation-guided Multimodal Pretraining for Mammography Classification

Xujun Li, Xin Wei, Jing Jiang, Danxiang Chen, Wei Zhang, Jinpeng Li

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11638 2024-08-22 eess.AS 71%

Improving Query-by-Vocal Imitation with Contrastive Learning and Audio Pretraining

Jonathan Greif, Florian Schmid, Paul Primus, Gerhard Widmer

专题命中 预训练与数据 :pretraining(title)

Comments Accepted to the DCASE Workshop 2024. Source code available: https://github.com/Jonathan-Greif/QBV

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08961 2024-07-15 eess.IV cs.CV 71%

Tissue-Contrastive Semi-Masked Autoencoders for Segmentation Pretraining on Chest CT

Jie Zheng, Ru Wen, Haiqin Hu, Lina Wei, Kui Su, Wei Chen, Chen Liu, Jun Wang

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.12730 2024-03-27 cs.CV 71%

A Closer Look at the Few-Shot Adaptation of Large Vision-Language Models

Julio Silva-Rodríguez, Sina Hajimiri, Ismail Ben Ayed, Jose Dolz

专题命中 预训练与数据 :language model(title)

Comments CVPR 2024. Code: https://github.com/jusiro/CLAP

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13064 2024-03-21 cs.CV 71%

SceneScript: Reconstructing Scenes With An Autoregressive Structured Language Model

Armen Avetisyan, Christopher Xie, Henry Howard-Jenkins, Tsun-Yi Yang, Samir Aroudj, Suvam Patra, Fuyang Zhang, Duncan Frost, Luke Holland, Campbell Orme, Jakob Engel, Edward Miller, Richard Newcombe, Vasileios Balntas

专题命中 预训练与数据 :language model(title)

Comments see project page, https://projectaria.com/scenescript

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.11440 2024-03-19 cs.CV 71%

Boosting Continuous Emotion Recognition with Self-Pretraining using Masked Autoencoders, Temporal Convolutional Networks, and Transformers

Weiwei Zhou, Jiada Lu, Chenkun Ling, Weifeng Wang, Shaowei Liu

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.00385 2024-03-19 eess.IV cs.CV 71%

Cross-Shaped Windows Transformer with Self-supervised Pretraining for Clinically Significant Prostate Cancer Detection in Bi-parametric MRI

Yuheng Li, Jacob Wynne, Jing Wang, Richard L. J. Qiu, Justin Roper, Shaoyan Pan, Ashesh B. Jani, Tian Liu, Pretesh R. Patel, Hui Mao, Xiaofeng Yang

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16648 2023-12-29 cs.RO cs.CV 71%

LIP-Loc: LiDAR Image Pretraining for Cross-Modal Localization

Sai Shubodh Puligilla, Mohammad Omama, Husain Zaidi, Udit Singh Parihar, Madhava Krishna

专题命中 预训练与数据 :pretraining(title)

Comments To be presented at WACV-W 2024. Project page: https://shubodhs.ai/liploc

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.16269 2023-11-30 cs.CV 71%

RSPrompter: Learning to Prompt for Remote Sensing Instance Segmentation based on Visual Foundation Model

Keyan Chen, Chenyang Liu, Hao Chen, Haotian Zhang, Wenyuan Li, Zhengxia Zou, Zhenwei Shi

专题命中 预训练与数据 :foundation model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01546 2023-10-31 cs.SD eess.AS 71%

Pretraining Conformer with ASR or ASV for Anti-Spoofing Countermeasure

Yikang Wang, Hiromitsu Nishizaki, Ming Li

专题命中 预训练与数据 :pretraining(title)

Comments 7 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.07913 2023-09-15 cs.CV 71%

A Survivor in the Era of Large-Scale Pretraining: An Empirical Study of One-Stage Referring Expression Comprehension

Gen Luo, Yiyi Zhou, Jiamu Sun, Xiaoshuai Sun, Rongrong Ji

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06571 2023-08-21 cs.CV 71%

Gradient-Regulated Meta-Prompt Learning for Generalizable Vision-Language Models

Juncheng Li, Minghe Gao, Longhui Wei, Siliang Tang, Wenqiao Zhang, Mengze Li, Wei Ji, Qi Tian, Tat-Seng Chua, Yueting Zhuang

专题命中 预训练与数据 :language model(title)

Comments Accepted by ICCV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.01669 2023-06-06 eess.AS cs.SD eess.SP 71%

Channel-Aware Pretraining of Joint Encoder-Decoder Self-Supervised Model for Telephonic-Speech ASR

Vrunda N. Sukhadia, A. Arunkumar, S. Umesh

专题命中 预训练与数据 :pretraining(title)

Comments 5 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.11733 2023-06-01 cs.CV 71%

Teaching Structured Vision&Language Concepts to Vision&Language Models

Sivan Doveh, Assaf Arbelle, Sivan Harary, Rameswar Panda, Roei Herzig, Eli Schwartz, Donghyun Kim, Raja Giryes, Rogerio Feris, Shimon Ullman, Leonid Karlinsky

专题命中 预训练与数据 :language model(title)

Journal ref CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.06052 2023-05-11 cs.CV 71%

Post-training Model Quantization Using GANs for Synthetic Data Generation

Athanasios Masouris, Mansi Sharma, Adrian Boguszewski, Alexander Kozlov, Zhuo Wu, Raymond Lo

专题命中 预训练与数据 :post-training(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.18230 2023-04-03 cs.CV 71%

Procedure-Aware Pretraining for Instructional Video Understanding

Honglu Zhou, Roberto Martín-Martín, Mubbasir Kapadia, Silvio Savarese, Juan Carlos Niebles

专题命中 预训练与数据 :pretraining(title)

Comments CVPR 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.02489 2023-03-16 cs.CV 71%

CapDet: Unifying Dense Captioning and Open-World Detection Pretraining

Yanxin Long, Youpeng Wen, Jianhua Han, Hang Xu, Pengzhen Ren, Wei Zhang, Shen Zhao, Xiaodan Liang

专题命中 预训练与数据 :pretraining(title)

Comments Accepted by CVPR2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.09340 2023-02-21 cs.IR 71%

Ensemble Ranking Model with Multiple Pretraining Strategies for Web Search

Xiaojie Sun, Lulu Yu, Yiting Wang, Keping Bi, Jiafeng Guo

专题命中 预训练与数据 :pretraining(title)

Comments 4 pages, 2 figures, WSDM Cup 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.17322 2022-11-01 cs.CV 71%

Generative Negative Text Replay for Continual Vision-Language Pretraining

Shipeng Yan, Lanqing Hong, Hang Xu, Jianhua Han, Tinne Tuytelaars, Zhenguo Li, Xuming He

专题命中 预训练与数据 :pretraining(title)

Comments ECCV 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.10633 2022-10-20 cs.CV 71%

Depth Contrast: Self-Supervised Pretraining on 3DPM Images for Mining Material Classification

Prakash Chandra Chhipa, Richa Upadhyay, Rajkumar Saini, Lars Lindqvist, Richard Nordenskjold, Seiichi Uchida, Marcus Liwicki

专题命中 预训练与数据 :pretraining(title)

Comments Accepted to CVF European Conference on Computer Vision Workshop(ECCVW 2022)

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.00804 2022-09-30 cs.CV 71%

PreViTS: Contrastive Pretraining with Video Tracking Supervision

Brian Chen, Ramprasaath R. Selvaraju, Shih-Fu Chang, Juan Carlos Niebles, Nikhil Naik

专题命中 预训练与数据 :pretraining(title)

Comments To be presented at WACV 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2205.07993 2022-05-18 cs.RO 71%

Generalizable Task Planning through Representation Pretraining

Chen Wang, Danfei Xu, Li Fei-Fei

专题命中 预训练与数据 :pretraining(title)

详情

展开后加载摘要…

URL PDF HTML 收藏