arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12429 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 12429 篇

2505.11401 2025-05-19 cs.CY 78%

Can AI automatically analyze public opinion? A LLM agents-based agentic pipeline for timely public opinion analysis

Jing Liu, Xinxing Ren, Yanmeng Xu, Zekun Guo

专题命中 预训练与数据 :LLM(title,abstract)

Comments 43 pages, 3 figures, 4 tables (1 in appendix), includes appendix. Preprint only

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.06356 2025-05-13 cs.CV 78%

Understanding and Mitigating Toxicity in Image-Text Pretraining Datasets: A Case Study on LLaVA

Karthik Reddy Kanjula, Surya Guthikonda, Nahid Alam, Shayekh Bin Islam

机构 * Cohere for AI Community(Cohere for AI社区) Cisco Meraki Indiana University Bloomington(印第安纳大学布卢明顿分校) Bangladesh University of Engineering and Technology(孟加拉工程与技术大学)

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Accepted at ReGenAI CVPR2025 Workshop as Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11370 2025-05-13 cs.CV 78%

Transmission Line Defect Detection Based on UAV Patrol Images and Vision-language Pretraining

Ke Zhang, Zhaoye Zheng, Yurong Guo, Jiacun Wang, Jiyuan Yang, Yangjie Xiao

机构 * Department of Electronic and Communication Engineering, North China Electric Power University(电子与通信工程系,华北电力大学) Hebei Key Laboratory of Power Internet of Things Technology, North China Electric Power University(河北省电力物联网技术重点实验室,华北电力大学) Computer Science and Software Engineering Department, Monmouth University(计算机科学与软件工程系,蒙特莫恩大学)

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24166 2025-05-12 cs.CV 78%

Foundation Models For Seismic Data Processing: An Extensive Review

Fabian Fuchs, Mario Ruben Fernandez, Norman Ettrich, Janis Keuper

机构 * Fraunhofer-Institut für Techno- und Wirtschaftsmathematik(弗劳恩霍夫技术与经济数学研究所) University of Mannheim(曼海姆大学) DWS, University of Mannheim(曼海姆大学) IMLA, Offenburg University(奥芬堡大学)

专题命中 预训练与数据 :foundation model(title,abstract)

Comments In submission to Geophysics

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11341 2025-05-12 cs.CV 78%

Self-Supervised Pretraining for Fine-Grained Plankton Recognition

Joona Kareinen, Tuomas Eerola, Kaisa Kraft, Lasse Lensu, Sanna Suikkanen, Heikki Kälviäinen

机构 * LUT University, Computer Vision and Pattern Recognition Laboratory(卢霍斯大学) Finnish Environment Institute(芬兰环境研究所) Brno University of Technology, Faculty of Information Technology(布拉格技术大学)

专题命中 预训练与数据 :pretraining(title,abstract)

Comments CVPR 2025, FGVC12 workshop paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.03220 2025-05-07 cs.CV 78%

Dual-Domain Masked Image Modeling: A Self-Supervised Pretraining Strategy Using Spatial and Frequency Domain Masking for Hyperspectral Data

Shaheer Mohamed, Tharindu Fernando, Sridha Sridharan, Peyman Moghadam, Clinton Fookes

机构 * Queensland University of Technology(昆士兰技术大学) CSIRO Robotics, Data61, CSIRO(CSIRO机器人部、Data61、CSIRO)

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Preprint to appear in IEEE IGARSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20800 2025-04-30 cs.CV 78%

Adept: Annotation-Denoising Auxiliary Tasks with Discrete Cosine Transform Map and Keypoint for Human-Centric Pretraining

Weizhen He, Yunfeng Yan, Shixiang Tang, Yiheng Deng, Yangyang Zhong, Pengxin Luo, Donglian Qi

机构 * College of Electrical Engineering, Zhejiang University(浙江大学电气工程学院) School of Mechanical Engineering, Zhejiang University(浙江大学机械工程学院) Ocean College, Zhejiang University(浙江大学海洋学院) Hainan Institute, Zhejiang University(海南研究院) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18608 2025-04-29 cs.CR 78%

ECG Identity Authentication in Open-set with Multi-model Pretraining and Self-constraint Center & Irrelevant Sample Repulsion Learning

Mingyu Dong, Zhidong Zhao, Hao Wang, Yefei Zhang, Yanjun Deng

专题命中 预训练与数据 :pretraining(title,abstract)

Comments 10 pages,

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19545 2025-04-29 cs.CV 78%

MENTOR: Human Perception-Guided Pretraining for Increased Generalization

Colton R. Crum, Adam Czajka

机构 * University of Notre Dame(内布拉斯加大学)

专题命中 预训练与数据 :pretraining(title,abstract)

Comments 10 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15921 2025-04-23 cs.CV 78%

ViSMaP: Unsupervised Hour-long Video Summarisation by Meta-Prompting

Jian Hu, Dimitrios Korkinof, Shaogang Gong, Mariano Beguerisse-Diaz

机构 * Queen Mary University of London(伦敦玛丽女王大学) Spotify

专题命中 预训练与数据 :prompting(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.13402 2025-04-21 cs.CV 78%

CytoFM: The first cytology foundation model

Vedrana Ivezić, Ashwath Radhachandran, Ekaterina Redekop, Shreeram Athreya, Dongwoo Lee, Vivek Sant, Corey Arnold, William Speier

机构 * University of California, Los Angeles, USA(加州大学洛杉矶分校)

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.10344 2025-04-15 cs.SD 78%

ALMTokenizer: A Low-bitrate and Semantic-rich Audio Codec Tokenizer for Audio Language Modeling

Dongchao Yang, Songxiang Liu, Haohan Guo, Jiankun Zhao, Yuanyuan Wang, Helin Wang, Zeqian Ju, Xubo Liu, Xueyuan Chen, Xu Tan, Xixin Wu, Helen Meng

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08739 2025-04-15 cs.IR cs.HC 78%

Enhancing Product Search Interfaces with Sketch-Guided Diffusion and Language Agents

Edward Sun

专题命中 预训练与数据 :language agent(title,abstract)

Comments Companion Proceedings of the ACM Web Conference 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06741 2025-04-10 cs.CV 78%

Large Scale Supervised Pretraining For Traumatic Brain Injury Segmentation

Constantin Ulrich, Tassilo Wald, Fabian Isensee, Klaus H. Maier-Hein

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.08872 2025-04-09 cs.IT eess.SP math.IT 78%

Large Wireless Model (LWM): A Foundation Model for Wireless Channels

Sadjad Alikhani, Gouranga Charan, Ahmed Alkhateeb

专题命中 预训练与数据 :foundation model(title,abstract)

Comments The LWM model and relevant scripts are available on the LWM website: https://lwm-wireless.net/

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02801 2025-04-04 cs.CV 78%

F-ViTA: Foundation Model Guided Visible to Thermal Translation

Jay N. Paranjape, Celso de Melo, Vishal M. Patel

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02747 2025-04-04 cs.GR 78%

GEOPARD: Geometric Pretraining for Articulation Prediction in 3D Shapes

Pradyumn Goyal, Dmitry Petrov, Sheldon Andrews, Yizhak Ben-Shabat, Hsueh-Ti Derek Liu, Evangelos Kalogerakis

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00191 2025-04-02 cs.CV 78%

Leveraging Diffusion Model and Image Foundation Model for Improved Correspondence Matching in Coronary Angiography

Lin Zhao, Xin Yu, Yikang Liu, Xiao Chen, Eric Z. Chen, Terrence Chen, Shanhui Sun

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19982 2025-03-27 cs.CV 78%

SLIP: Spoof-Aware One-Class Face Anti-Spoofing with Language Image Pretraining

Pei-Kai Huang, Jun-Xiong Chong, Cheng-Hsuan Chiang, Tzu-Hsien Chen, Tyng-Luh Liu, Chiou-Ting Hsu

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Accepted by AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14418 2025-03-27 eess.AS cs.CV eess.SP 78%

Role of the Pretraining and the Adaptation data sizes for low-resource real-time MRI video segmentation

Masoud Thajudeen Tholan, Vinayaka Hegde, Chetan Sharma, Prasanta Kumar Ghosh

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Accepted to ICASSP 2025

Journal ref IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), Hyderabad, India, 2025, pp. 1-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10674 2025-03-25 cs.CV 78%

Occlusion-aware Text-Image-Point Cloud Pretraining for Open-World 3D Object Recognition

Khanh Nguyen, Ghulam Mubashar Hassan, Ajmal Mian

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18158 2025-03-25 cs.RO cs.CV 78%

3D-MVP: 3D Multiview Pretraining for Robotic Manipulation

Shengyi Qian, Kaichun Mo, Valts Blukis, David F. Fouhey, Dieter Fox, Ankit Goyal

专题命中 预训练与数据 :pretraining(title,abstract)

Comments CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16970 2025-03-24 cs.CV 78%

Distilling Monocular Foundation Model for Fine-grained Depth Completion

Yingping Liang, Yutao Hu, Wenqi Shao, Ying Fu

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14304 2025-03-19 eess.IV cs.CV 78%

RoMedFormer: A Rotary-Embedding Transformer Foundation Model for 3D Genito-Pelvic Structure Segmentation in MRI and CT

Yuheng Li, Mingzhe Hu, Richard L. J. Qiu, Maria Thor, Andre Williams, Deborah Marshall, Xiaofeng Yang

专题命中 预训练与数据 :foundation model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20256 2025-03-13 cs.CV 78%

Do computer vision foundation models learn the low-level characteristics of the human visual system?

Yancheng Cai, Fei Yin, Dounia Hammou, Rafal Mantiuk

专题命中 预训练与数据 :foundation model(title,abstract)

Comments Accepted by CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07514 2025-03-12 cs.CV 78%

CNN-JEPA: Self-Supervised Pretraining Convolutional Neural Networks Using Joint Embedding Predictive Architecture

András Kalapos, Bálint Gyires-Tóth

专题命中 预训练与数据 :pretraining(title,abstract)

Comments Preprint

Journal ref 2024 International Conference on Machine Learning and Applications (ICMLA), Miami, FL, USA, 2024, pp. 1111-1114

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16512 2025-03-11 cs.CV 78%

TIPS: Text-Image Pretraining with Spatial awareness

Kevis-Kokitsi Maninis, Kaifeng Chen, Soham Ghosh, Arjun Karpur, Koert Chen, Ye Xia, Bingyi Cao, Daniel Salz, Guangxing Han, Jan Dlabal, Dan Gnanapragasam, Mojtaba Seyedhosseini, Howard Zhou, Andre Araujo

专题命中 预训练与数据 :pretraining(title,abstract)

Comments ICLR2025 camera-ready + appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17860 2025-02-28 cs.CV 78%

UniGS: Unified Language-Image-3D Pretraining with Gaussian Splatting

Haoyuan Li, Yanpeng Zhou, Tao Tang, Jifei Song, Yihan Zeng, Michael Kampffmeyer, Hang Xu, Xiaodan Liang

专题命中 预训练与数据 :pretraining(title);language model(abstract)

Comments ICLR 2025; Corrected citation of Uni3D;

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13883 2025-02-20 cs.CV 78%

Multi-view Video-Pose Pretraining for Operating Room Surgical Activity Recognition

Idris Hamoud, Vinkle Srivastav, Muhammad Abdullah Jamal, Didier Mutter, Omid Mohareri, Nicolas Padoy

专题命中 预训练与数据 :pretraining(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10472 2025-02-20 cs.SE 78%

Towards Semantic Versioning of Open Pre-trained Language Model Releases on Hugging Face

Adekunle Ajibode, Abdul Ali Bangash, Filipe Roseiro Cogo, Bram Adams, Ahmed E. Hassan

专题命中 预训练与数据 :language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏