arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

2025-12-25 至 2025-12-25 共收录 1 信号源:cs.RO, cs.CV, cs.AI, cs.LG
2512.05107 2025-12-25 cs.RO 91%

STARE-VLA: Progressive Stage-Aware Reinforcement for Fine-Tuning Vision-Language-Action Models

STARE-VLA:渐进式阶段感知强化用于视觉-语言-动作模型微调

Feng Xu, Guangyao Zhai, Xin Kong, Tingzhong Fu, Daniel F. N. Gordon, Xueli An, Benjamin Busam

机构 * Munich Research Center, Huawei Technologies(慕尼黑研究中心,华为技术)

专题命中 VLA模型 :vision-language-action(title,abstract);VLA(title,abstract);action model(title);分类 cs.RO

AI总结 STARE-VLA通过渐进式阶段感知强化方法,提升视觉-语言-动作模型的动作准确性,实现SimplerEnv和ManiSkill3任务中的高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏