Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving
机构 * LiAuto ; Tsinghua University(清华大学)
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CL、cs.AI
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
机构 * LiAuto ; Tsinghua University(清华大学)
专题命中 多模态生成 :multimodal(abstract);multi-modal(abstract);分类 cs.CL、cs.AI
机构 * JDH Algo(京东健康算法)
专题命中 多模态生成 :multimodal(abstract);分类 cs.CV、cs.CL、cs.AI
机构 * Information and Communication Engineering(信息与通信工程) ; Dalian University of Technology(大连理工大学) ; ZMO.AI Inc.(ZMO.AI公司) ; University of Electronic Science and Technology of China(电子科技大学)
专题命中 多模态生成 :image-text(abstract);分类 cs.CV
机构 * Beijing Normal University China ; Unmanned Vehicle Dept., Cainiao, Alibaba \& State Key Lab of CAD\&CG, Zhejiang University China ; Unmanned Vehicle Dept., Cainiao, Alibaba China ; Baidu China ; State Key Lab of CAD\&CG, Zhejiang University China ; Beijing Normal University ; Unmanned Vehicle Dept., Cainiao, Alibaba \& State Key Lab of CAD\&CG, Zhejiang University ; Unmanned Vehicle Dept., Cainiao, Alibaba ; Baidu ; State Key Lab of CAD\&CG, Zhejiang University
专题命中 多模态生成 :multi-modal(abstract);分类 cs.CV
专题命中 多模态生成 :multimodal(abstract)