遇见数据集

Stanford MaskVIT Data

收藏
OpenXLab2026-04-18 收录
官方服务:

资源简介:

MaskViT在视频预测中优于先前的工作是参数有效的, 并且可以生成高分辨率视频(256×256)。此外,我们展示 由于我们在真实机器人上使用MaskViT进行迭代解码,推理速度加快(高达512×)的好处。我们的工作表明,我们可以通过利用 最小领域知识的掩蔽视觉建模框架。

提供机构:
OpenDataLab
创建时间:
2023-10-20
二维码
社区交流群
二维码
科研交流群
商业服务