Towards Improving Document Understanding: An Exploration on Text-Grounding via MLLMs
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CV
Comments 18 pages, 9 figures
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
Comments 12 pages
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 eess.AS
Comments Proceedings of Interspeech 2023; v4 version updates: correction of W2V2-base pretrained on 960-hour of LibriSpeech and number of families participated for LENA home recordings
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :image-text(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
Comments 8
专题命中 多模态训练与对齐 :image-text(abstract);分类 cs.CV
Comments 16 pages, 7 figures
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CL
Comments to be published in EMNLP 2023
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CV
Comments Accepted by IJCAI 2023. Code is available at https://github.com/Flame-Chasers/RaSa
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CL
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
Comments 10 pages, 8 figures
专题命中 多模态训练与对齐 :image-text(abstract);分类 cs.CV
Comments Accepted by IEEE Transactions on Neural Networks and Learning Systems (TNNLS)
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
Comments Accepted to IEEE TIP
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.AI
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
Comments 10 pages, 4 figures
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
Comments 10 pages, 2 figures, 3 tables, accepted for publication in WACV 2024
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CV
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.AI
Journal ref Transactions on Machine Learning Research (TMLR) 2023
专题命中 多模态训练与对齐 :image-text(abstract);分类 cs.CV
Comments Accepted by NeurIPS 2023
专题命中 多模态训练与对齐 :cross-modal(abstract);分类 cs.CV
Comments NeurIPS 2023 (Spotlight); 37 pages, 16 figures, 15 tables; Code at https://github.com/youquanl/Segment-Any-Point-Cloud
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CV
Comments MICCAI 2023, released code: https://github.com/lhaof/VAPL
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CL
专题命中 多模态训练与对齐 :multimodal(abstract);分类 cs.CL
Comments Accepted as a long paper in the main conference of EMNLP 2023
专题命中 多模态训练与对齐 :multi-modal(abstract);分类 cs.CL