arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

多模态大模型

跨文本、图像、视频、音频等模态的大模型与学习方法。

2025-10-24 至 2025-10-24 共收录 4 信号源:cs.CV, cs.CL, cs.AI, cs.MM, eess.AS

1. 多模态生成 4 篇

2510.20637 2025-10-24 cs.LG 78%

Large Multimodal Models-Empowered Task-Oriented Autonomous Communications: Design Methodology and Implementation Challenges

Hyun Jong Yang, Hyunsoo Kim, Hyeonho Noh, Seungnyun Kim, Byonghyo Shim

机构 * Seoul National University(首尔国立大学) Hanbat National University(翰baum国立大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 多模态生成 :multimodal(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20595 2025-10-24 stat.ML cs.LG 78%

Diffusion Autoencoders with Perceivers for Long, Irregular and Multimodal Astronomical Sequences

Yunyi Shen, Alexander Gagliano

机构 * EECS, MIT(麻省理工学院电子工程与计算机科学系) IAIFI, MIT(麻省理工学院天文研究所) CfA, Harvard(哈佛大学天文台)

专题命中 多模态生成 :multimodal(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00565 2025-10-24 stat.CO cs.LG math.ST stat.TH 78%

Sampling from multi-modal distributions with polynomial query complexity in fixed dimension via reverse diffusion

Adrien Vacher, Omar Chehab, Anna Korba

机构 * CREST, ENSAE Institut Polytechnique de Paris(CREST,ENSAE 巴黎高等理工学院)

专题命中 多模态生成 :multi-modal(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15382 2025-10-24 cs.LG cs.AI cs.RO 57%

Towards Robust Zero-Shot Reinforcement Learning

Kexin Zheng, Lauriane Teyssier, Yinan Zheng, Yu Luo, Xianyuan Zhan

机构 * The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 多模态生成 :multimodal(abstract);分类 cs.AI

Comments Neurips 2025, 29 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏