RePIC: Reinforced Post-Training for Personalizing Multi-Modal Language Models
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2025
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 图文多模态 :multi-modal(title,abstract);MLLM(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2025
专题命中 图文多模态 :cross-modal(title,abstract);multi-modal(abstract);分类 cs.CV
机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) ; School of Electronic and Information Engineering, Shenzhen University(深圳大学电子与信息工程学院) ; College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院) ; School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.AI
Comments 10 pages, 10 figures, CoLM 2025
机构 * Oracle AI
专题命中 图文多模态 :multimodal(title,abstract);分类 cs.CV、cs.CL、cs.AI
Comments Accepted in EMNLP 2025
机构 * Harvard Medical School, Harvard University(哈佛医学院、哈佛大学) ; Athinoula A. Martinos Center for Biomedical Imaging, Massachusetts General Hospital(阿提尼乌拉A.马丁努斯生物医学成像中心、麻省总医院) ; Knovel Engineering Lab, Singapore(Knovel工程实验室、新加坡)
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
机构 * Tsinghua University(清华大学) ; Pengcheng Laboratory(鹏城实验室) ; Guangming Laboratory(光明实验室) ; Ant Group(蚂蚁集团) ; Columbia University(哥伦比亚大学) ; Southern University of Science and Technology(南方科技大学)
专题命中 图文多模态 :multi-modal(title);multimodal(abstract);image-text(abstract);分类 cs.AI
机构 * Department of Computer Science, Durham University(计算机科学系,杜伦大学)
专题命中 图文多模态 :cross-modal(title);multimodal(abstract);MLLM(abstract);分类 cs.CV
机构 * University of California Santa Cruz(加州大学圣克鲁兹分校) ; Apple(苹果公司) ; University of California Berkeley(加州大学伯克利分校)
专题命中 图文多模态 :multimodal(title,abstract);multimodal foundation model(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title);multi-modal(abstract);image-text(abstract);分类 cs.CV
Comments 9 pages
机构 * School of Computer Science and Engineering, Southeast University, China(东南大学计算机科学与工程学院) ; Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications, Ministry of Education, China(教育部新一代人工智能技术及其交叉应用重点实验室) ; Nanjing University of Science and Technology, Nanjing, China(南京理工大学) ; Agency for Science, Technology and Research (A*STAR), Singapore(新加坡科技研究局)
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
Comments Early Accepted by The International Conference on Medical Image Computing and Computer Assisted Intervention(MICCAI)2024
机构 * HyperVerge
专题命中 图文多模态 :image-text(title,abstract);multi-modal(abstract);分类 cs.CV
机构 * KIIT Deemed University(KIIT大学) ; Indian Institute of Technology (IIT) Bhubaneswar(印度理工学院(Bhubaneswar分校))
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CL
Comments Accepted at ASI @ ICCV 2025
机构 * Carnegie Mellon University(卡内基梅隆大学)
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CV
机构 * The University of Sydney(悉尼大学) ; DeepGlint ; Imperial College London(伦敦帝国学院)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments 15 pages, 12 figures, Accepted by ACM MM2025, Webpage: https://garygutc.github.io/RealSyn
专题命中 图文多模态 :cross-modal(title,abstract);image-text(abstract);分类 cs.CV
机构 * University of Science and Technology of China(中国科学技术大学) ; WeChat Vision, Tencent Inc.(腾讯公司)
专题命中 图文多模态 :image-text(title,abstract);cross-modal(abstract);分类 cs.CV
机构 * Singapore Institute of Management(新加坡管理学院)
专题命中 图文多模态 :multimodal(title,abstract);multi-modal(abstract);分类 cs.CL
机构 * University of Notre Dame(诺丁汉大学) ; University of Pennsylvania(宾夕法尼亚大学) ; Georgia Institute of Technology(佐治亚理工学院) ; Dartmouth College(达特茅斯学院)
专题命中 图文多模态 :multimodal(title,abstract);MLLM(abstract);分类 cs.CL
Comments ACL 2025 Main Conference
机构 * Technical University of Munich(慕尼黑技术大学) ; Helmholtz-Zentrum Dresden-Rossendorf(德累斯顿-罗斯托克亥姆霍尔茨中心)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
Comments code & weights: https://github.com/xiong-zhitong/DOFA-CLIP
机构 * School of Information and Technology, Northwest University(信息与技术学院,西北大学)
专题命中 图文多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments 21 pages, 8 figures
机构 * Huazhong University of Science and Technology(华中科技大学) ; La Trobe University(拉特罗布大学)
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.MM
机构 * University of California, San Diego(加州大学圣地亚哥分校)
专题命中 图文多模态 :multi-modal(title,abstract);cross-modal(abstract);分类 cs.AI
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.CV
机构 * Boston University(波士顿大学) ; MIT Lincoln Laboratory(麻省理工学院林肯实验室)
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院) ; Tsinghua University(清华大学) ; Institute of automation, Chinese academy of science(中国科学院自动化研究所) ; School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院)
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.AI
机构 * Agency for Defense Development(国防发展机构) ; Sookmyung Women’s University(苏镜女子大学)
专题命中 图文多模态 :multimodal(title,abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted at IEEE/CVF WACV 2025, pp.6115-6124, 2025
Journal ref Proceedings of the Winter Conference on Applications of Computer Vision (WACV), 2025, pp.6115-6124
专题命中 图文多模态 :multimodal(title,abstract);image-text(abstract);分类 cs.MM