QuoVLA: Quotient Space for Vision-Language-Action Models
QuoVLA:视觉-语言-动作模型的商空间
机构 * Department of Automation(自动化系)
专题命中 效率与部署 :language model(abstract)
AI总结 针对VLA模型预训练VLM潜在表示动作信息不足的观点,提出商空间框架QuoVLA,通过量化模块和双分支设计压缩潜在表示为动作充分表示,在多个基准上提升泛化性能。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
QuoVLA:视觉-语言-动作模型的商空间
机构 * Department of Automation(自动化系)
专题命中 效率与部署 :language model(abstract)
AI总结 针对VLA模型预训练VLM潜在表示动作信息不足的观点,提出商空间框架QuoVLA,通过量化模块和双分支设计压缩潜在表示为动作充分表示,在多个基准上提升泛化性能。