Security Risk of Misalignment between Text and Image in Multi-modal Model
机构 * Xidian University(西安电子科技大学) ; Shanghai Jiaotong University(上海交通大学)
专题命中 文生图 :text-to-image(abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
视觉与机器人
图像生成、文生图、图像编辑、扩散模型和可控生成。
机构 * Xidian University(西安电子科技大学) ; Shanghai Jiaotong University(上海交通大学)
专题命中 文生图 :text-to-image(abstract);diffusion(abstract);inpainting(abstract);分类 cs.CV
机构 * University of California Santa Cruz(加州大学圣克ruz分校) ; Northeastern University(东北大学) ; Accenture(Accenture公司)
专题命中 文生图 :image generation(abstract);text-to-image(abstract);diffusion(abstract);分类 cs.CV
Comments NeurIPS 2025
机构 * Microsoft Research Asia(微软亚洲研究院) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 文生图 :text-to-image(abstract)
Comments This paper is a sequel to the CHI 24 paper "Where Are We So Far? Understanding Data Storytelling Tools from the Perspective of Human-AI Collaboration (https://doi.org/10.1145/3613904.3642726), aiming to refresh our understanding with the latest advancements. It is accepted at IEEE VIS 25