ActiveVLA: Injecting Active Perception into Vision-Language-Action Models for Precise 3D Robotic Manipulation
ActiveVLA: 向视觉-语言-动作模型注入主动感知以实现精确的3D机器人操控
机构 * Fudan University(复旦大学) ; Shanghai Innovation Institute(上海创新研究院) ; Nanyang Technological University(南洋理工大学)
专题命中 GUI与屏幕智能体 :vision-language model(abstract)
AI总结 ActiveVLA通过引入主动感知能力,提升机器人在复杂环境中的高精度3D操控性能。