Enhancing End-to-End Autonomous Driving with Risk Semantic Distillaion from VLM
机构 * Tsinghua University(清华大学) ; Laboratories, Huawei Technologies(华为技术有限公司2012实验室)
专题命中 GUI与屏幕智能体 :VLM(title,abstract);vision-language model(abstract);分类 cs.CV
AI 大模型
视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。
机构 * Tsinghua University(清华大学) ; Laboratories, Huawei Technologies(华为技术有限公司2012实验室)
专题命中 GUI与屏幕智能体 :VLM(title,abstract);vision-language model(abstract);分类 cs.CV