Serendipitous Recommendation with Multimodal LLM
专题命中 视频多模态 :multimodal(title,abstract);MLLM(abstract)
Comments Accepted by 2025 Recsys EARL Workshop
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 视频多模态 :multimodal(title,abstract);MLLM(abstract)
Comments Accepted by 2025 Recsys EARL Workshop
机构 * Seoul National University(首尔国立大学) ; Hanyang University(翰阳大学) ; Hyundai Motor Company(现代汽车公司)
专题命中 视频多模态 :cross-modal(title,abstract);分类 cs.CV
Comments Accepted at ICCV 2025
机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室) ; ByteDance(字节跳动)
专题命中 视频多模态 :multimodal(title,abstract);分类 cs.CV
Comments NeurIPS 2025. (v3: update to include video understanding, OneIG, and more ablation study results)
专题命中 视频多模态 :multimodal(title,abstract)
专题命中 视频多模态 :multi-modal(title,abstract)
机构 * Max Planck ETH CLS(马克斯·普朗克-ETH CLS) ; German Research Foundation(德国研究基金会) ; Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ; ETH Zürich(苏黎世联邦理工学院) ; Institute for Data Science in Mechanical Engineering (DSME)(机械工程数据科学研究所) ; RWTH Aachen University(亚琛工业大学)
专题命中 视频多模态 :multi-modal(title,abstract)
机构 * ITI, CERTH(ITI、CERTH)
专题命中 视频多模态 :multimodal(abstract);cross-modal(abstract);分类 cs.CV、cs.AI、cs.MM
Comments In ACM Multimedia 2025, DOI:10.1145/3746027.3755821
专题命中 视频多模态 :multimodal(abstract);分类 cs.CV、cs.AI
机构 * Kuaishou Technology(快手科技)
专题命中 视频多模态 :multimodal(abstract);分类 cs.AI