arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2025-08-22 至 2025-08-22 共收录 1 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 多模态生成 1 篇

2505.22306 2025-08-22 cs.LG cs.AI 57%

Versatile Cardiovascular Signal Generation with a Unified Diffusion Transformer

Zehua Chen, Yuyang Miao, Liyuan Wang, Luyun Fan, Danilo P. Mandic, Jun Zhu

机构 * Department of Computer Science and Technology, Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint Center for ML, Tsinghua University, Beijing, China(计算机科学与技术系、人工智能研究院、BNRist中心、THBI实验室、清华大学-博世联合机器学习中心、清华大学、北京,中国) Department of Psychological and Cognitive Sciences, Tsinghua University, Beijing, China(心理学与认知科学系、清华大学、北京,中国) Department of Electrical and Electronic Engineering, Imperial College London, London, United Kingdom(电子与电气工程系、伦敦帝国理工学院、伦敦,英国) Beijing Anzhen Hospital of Capital Medical University, Beijing Institute of Heart Lung and Blood Vessel Diseases, Chinese Institutes for Medical Research, Beijing, China(首都医科大学北京安贞医院、北京心肺血管疾病研究院、中国医学研究院、北京,中国)

专题命中 多模态生成 :multi-modal(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏