Plug-and-Play Clarifier: A Zero-Shot Multimodal Framework for Egocentric Intent Disambiguation
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments 16 pages, 9 figures, AAAI 2026
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV、cs.MM
Comments 16 pages, 9 figures, AAAI 2026
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.MM
Journal ref C. Li, Q. Yan, M. Kim, Z. Li, Y. Xu and L. -F. Yu, "Crafting Dynamic Virtual Activities with Advanced Multimodal Models," 2025 IEEE International Symposium on Mixed and Augmented Reality (ISMAR), pp. 120-130
专题命中 图文多模态 :multimodal(abstract);image-text(abstract);分类 cs.CV
机构 * Hong Kong University of Science and Technology(香港科技大学) ; Kyoto University(京都大学) ; Georgia Institute of Technology(佐治亚理工学院) ; The University of Texas at Dallas(德克萨斯大学达拉斯分校) ; University of Wisconsin-Madison(威斯康星大学麦迪逊分校) ; Cornell University(康奈尔大学) ; Indiana University(印第安纳大学) ; National Taiwan Normal University(台湾师范大学) ; University of Liverpool(利物浦大学) ; University of Edinburgh(爱丁堡大学) ; Zhejiang University(浙江大学) ; Purdue University(普渡大学) ; Emory University(埃默里大学) ; West China Biomedical Big Data Center, West China Hospital, Sichuan University(西京生物大数据中心,西京医院,四川大学)
专题命中 图文多模态 :multimodal(abstract);分类 cs.CL、cs.AI
Comments 25 pages, 5 tables
专题命中 图文多模态 :multimodal(abstract);分类 cs.CV
Comments Accepted to AAAI-2026 Oral
专题命中 图文多模态 :image-text(abstract);分类 cs.CV
Comments 7 pages, 5 figures