该方法使用渲染控制视频、参考图像和提示,生成对应的真实世界机器人视频行为。项目示例包括 DROID 训练域案例、未见夹爪、未见机器人形态,以及与基线控制表示的比较。
Masked Visual Actions 适用于机器人研究者、世界模型开发者以及构建动作条件视频预测系统的团队。它通过让动作信息变得可见且可迁移,在机器人控制信号与生成式视频模型之间建立了实用桥梁。
该方法使用渲染控制视频、参考图像和提示,生成对应的真实世界机器人视频行为。项目示例包括 DROID 训练域案例、未见夹爪、未见机器人形态,以及与基线控制表示的比较。
Masked Visual Actions 适用于机器人研究者、世界模型开发者以及构建动作条件视频预测系统的团队。它通过让动作信息变得可见且可迁移,在机器人控制信号与生成式视频模型之间建立了实用桥梁。
在您的网站添加此徽章,以获得更多点赞并登上搜索结果顶部!


Get top updates in AI to your inbox every weekend. It's free!