Mitty: Diffusion-based Human-to-Robot Video Generation
Mitty:基于扩散的Human-to-Robot视频生成
机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)
AI总结 Mitty通过基于扩散的变换器实现端到端的人机视频生成,利用预训练模型和双向注意力机制,无需动作标签或中间抽象,生成高质量的机器人执行视频。
高校专区
Mitty:基于扩散的Human-to-Robot视频生成
机构 * Show Lab, National University of Singapore(新加坡国立大学Show实验室)
AI总结 Mitty通过基于扩散的变换器实现端到端的人机视频生成,利用预训练模型和双向注意力机制,无需动作标签或中间抽象,生成高质量的机器人执行视频。
SIGN:通过强化学习实现安全的图像目标导航用于自主无人机
机构 * Department of Electrical and Computer Engineering, National University of Singapore(电子与计算机工程系,新加坡国立大学)
AI总结 本文提出了一种基于强化学习的仿真到现实框架,实现无人机的安全图像目标导航,通过直接速度控制和深度安全模块实现自主探索与避障。
Comments Accepted to IEEE Robotics and Automation Letters (RA-L)
Journal ref IEEE Robotics and Automation Letters, 2025
LookAhead Tuning: 通过部分答案预览实现更安全的语言模型
机构 * Zhejiang University(浙江大学) ; Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室) ; Ant Group(蚂蚁集团) ; National University of Singapore(新加坡国立大学)
AI总结 LookAhead Tuning通过预览部分答案前缀,有效保持语言模型在微调过程中的安全性,同时不损害下游任务的性能。
Comments WSDM 2026 short