Novel Category Discovery with X-Agent Attention for Open-Vocabulary Semantic Segmentation
专题命中 多模态Agent :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ACMMM2025
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
专题命中 多模态Agent :multi-modal(abstract);cross-modal(abstract);分类 cs.CV
Comments Accepted by ACMMM2025
机构 * School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳))
专题命中 多模态Agent :multimodal(abstract);image-text(abstract);分类 cs.CV
Comments Project Page: https://github.com/JiuTian-VL/Large-VLM-based-VLA-for-Robotic-Manipulation
机构 * University of California(加州大学)
专题命中 多模态Agent :multi-modal(abstract);分类 cs.CV、cs.CL、cs.AI
Comments 19th International Conference on Neurosymbolic Learning and Reasoning
机构 * School of Computer Science, University of Nottingham(诺丁汉大学计算机科学学院) ; School of Computing and Communications, The Open University(开放大学计算与通讯学院) ; School of Electronics and Computer Science, University of Southampton(南安普顿大学电子与计算机科学学院) ; Responsible AI, University of Southampton(南安普顿大学负责任的人工智能) ; University of Liverpool(利兹大学)
专题命中 多模态Agent :multimodal(abstract);分类 cs.AI
机构 * Deep Research Agents(深度研究代理)
专题命中 多模态Agent :multimodal(abstract);分类 cs.AI