A Modular Vision-Language-Action Robotics Framework for Indoor Environments
面向室内环境的模块化视觉-语言-动作机器人框架
机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) ; CMU(卡内基梅隆大学)
专题命中 GUI与屏幕智能体 :VLM(abstract,abstract_cn);vision-language model(abstract);分类 cs.AI
AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。
Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing