DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control
专题命中 GUI与屏幕智能体 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV
Comments The webpage is at https://dex-vla.github.io/. DexVLA is accepted by CoRL 2025
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
专题命中 GUI与屏幕智能体 :vision-language model(title,abstract);VLM(abstract);分类 cs.CV
Comments The webpage is at https://dex-vla.github.io/. DexVLA is accepted by CoRL 2025
机构 * Intelligent Space Robotics Laboratory, Skolkovo Institute of Science and Technology(智能空间机器人实验室,斯克洛科沃科学与技术研究所)
专题命中 GUI与屏幕智能体 :VLM(title,abstract);vision language model(abstract)
专题命中 GUI与屏幕智能体 :vision-language model(abstract);VLM(abstract);分类 cs.CV、cs.AI
机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; University of California, Berkeley(加州大学伯克利分校)
专题命中 GUI与屏幕智能体 :multimodal large language model(abstract);MLLM(abstract);分类 cs.CV
专题命中 GUI与屏幕智能体 :vision-language model(abstract);分类 cs.CV
机构 * OPPO AI Center(OPPO人工智能中心) ; Tsinghua University(清华大学)
专题命中 GUI与屏幕智能体 :multimodal large language model(abstract);分类 cs.CV
Comments Accepted to ICCV 2025