Explaining latent representations of generative models with large multimodal models
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments ICLR 2024 Workshop on Reliable and Responsible Foundation Models
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments ICLR 2024 Workshop on Reliable and Responsible Foundation Models
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CL、cs.AI、cs.MM
Comments 8 pages, 7 figures, ACM MM 2024
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments Code, models, and demo are available at https://github.com/invictus717/InteractiveVideo
专题命中 多模态生成 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.MM
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to Deep Generative Models for Health Workshop at NeurIPS 2023
专题命中 多模态生成 :multi-modal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments NeurIPS 2023 spotlight
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Project page & demo: https://aka.ms/biomedjourney
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted to EMNLP 2023 main conference
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments ICCV 2023
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.MM、eess.AS
专题命中 多模态生成 :any-to-any(title);multimodal(abstract);分类 cs.CV、cs.CL、eess.AS
Comments Project Page: https://codi-gen.github.io
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted by the 30th ACM International Conference on Multimedia (ACM MM 2022)
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract)
Comments Published in Advanced Robotics
Journal ref Advanced Robotics, 36:5-6, 261-278, 2022
专题命中 多模态生成 :multi-modal(title,abstract);分类 cs.CV、cs.AI、cs.MM
Comments arXiv admin note: text overlap with arXiv:2105.14211
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments CVPR Camera ready
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments ACM MM 2021 (Industrial Track). Code: https://github.com/researchmm/generate-it
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.MM
Comments ACL Fingdings 2021
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments visit https://fairytailor.org/ and https://github.com/EdenBD/MultiModalStory-demo for web demo and source code
专题命中 多模态生成 :multi-modal(title,abstract);cross-modal(abstract)
Comments 5 pages, 2 figures
专题命中 多模态生成 :multimodal(title,abstract);cross-modal(abstract)
Journal ref IEEE Transactions on Biomedical Engineering, 2019
专题命中 多模态生成 :multi-modal(title,abstract);multimodal(abstract)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments EMNLP 2018 (accepted)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments arXiv admin note: text overlap with arXiv:1612.04757
DGSSM:基于扩散引导的状态空间模型的多模态显著目标检测
机构 * Dept. of Computer Science and Engineering, Indian Institute of Technology, Guwahati(计算机科学与工程系,印度理工学院,果阿提)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.AI
AI总结 本文提出DGSSM,一种结合扩散模型结构先验和多尺度状态空间编码的多模态显著目标检测框架,通过迭代Mamba扩散细化机制提升边界精度,实验表明其在多个评估指标上优于现有方法。
Comments Accepted at ICPR 2026. Diffusion-guided Mamba framework for multimodal salient object detection. Evaluated on 13 benchmarks (RGB, RGB-D, RGB-T)
专题命中 多模态生成 :multimodal(title,abstract);分类 cs.CV、cs.AI
Comments This article is an earlier version of my work arXiv:2410.01820 "PixelBytes: Catching Unified Representation for Multimodal Generation."