Objaverse-XL-Rigged-Animated-Renders
收藏资源简介:
Objaverse-XL Rigged & Animated — Renders 是 Objaverse-XL Rigged & Animated 数据集的视觉渲染伴侣,后者包含 7,373 个带骨架和动画的 GLB 资产。本数据集仅包含从这些资产渲染得到的多视角视频和静态姿势网格,用于预览动画、视觉语言模型字幕以及评估骨架资产。数据集包含两部分:glb_render/:10,355 个文件夹,每个对应一个动画剪辑,内含四个视角的 MP4 视频(前、后、左、右)及对应的 JSON 相机参数文件。视频分辨率 512×512,帧率 30 fps,渲染自 Blender EEVEE,覆盖每个剪辑的前 200 帧(约 6.7 秒),较长剪辑被截断。JSON 文件包含 NeRF 约定的相机参数。tpose/:7,373 个 PNG 文件,每个资产一个 1024×1024 的 2×2 网格,展示资产的静态姿势(前、后、左、右视图),用于在导入前评估资产体型。数据规模:MP4 文件共 41,420 个(2.2 GB),PNG 文件 7,373 个。渲染帧数:每视图 957,818 帧(约 8.9 小时),四个视图总计 3,831,272 帧。文件夹名称与资产仓库中的 stems 一致,便于关联元数据。许可:每个渲染继承上游资产的原许可,需通过 Objaverse-XL 注释查询具体许可。引用:该数据集是 UniML3D 训练语料的一部分,相关论文为 UniMate: One Unified Model to Animate Diverse Skeletons(SIGGRAPH Asia 2026)。
Objaverse-XL Rigged & Animated — Renders is the visual rendering companion to the Objaverse-XL Rigged & Animated dataset, which contains 7,373 rigged and animated GLB assets. This dataset contains only multi-view videos and static pose grids rendered from these assets, used for previewing animations, vision-language model captioning, and evaluating skeleton assets. It consists of two parts: glb_render/ (10,355 folders, each containing MP4 videos from four viewpoints (front, back, left, right) and corresponding JSON camera parameter files; video resolution 512x512, 30 fps, rendered with Blender EEVEE, covering the first 200 frames of each clip, longer clips truncated; JSON files follow NeRF camera conventions) and tpose/ (7,373 PNG files, each a 1024x1024 2x2 grid showing the assets static pose from four views, for evaluating body shape before import). Data size: 41,420 MP4 files (2.2 GB), 7,373 PNG files. Rendered frames: 957,818 per view (~8.9 hours), total 3,831,272 frames across four views. Folder names match asset stems in the repository for metadata linking. License: Each render inherits the original license of the upstream asset; refer to Objaverse-XL annotations for specific licenses. Citation: This dataset is part of the UniML3D training corpus, with the related paper UniMate: One Unified Model to Animate Diverse Skeletons (SIGGRAPH Asia 2026).
Objaverse-XL Rigged & Animated — Renders 数据集详情
数据集简介
该数据集是 Linzhan/Objaverse-XL-Rigged-Animated 的可视化配套数据集,不包含原始3D资产生成文件,而是专注于预览运动、辅助VLM生成描述以及快速检查绑定效果。该数据集为每个动画片段提供四视角视频渲染,并为每个资产生成静止姿态(rest-pose)网格图。
规模与规格
| 内容 | 数量 |
|---|---|
| 渲染片段目录 | 10,355个文件夹 · 41,420个MP4 (2.2GB) |
| 静止姿态网格 | 7,373张PNG |
| 渲染总帧数 | 每视角 957,818 帧(约8.9小时),四视角合计 3,831,272 帧 |
| 分辨率/帧率 | 512×512 · 30 fps |
内容结构
glb_render/ 10,355个目录 每个骨架驱动片段的四视角视频渲染 tpose/ 7,373个.png 每个资产生成文件的静止姿态渲染网格
- 命名规则与资产仓库严格一致,可直接与其中的
metadata.csv/animations.csv关联。
渲染详情
视频渲染(glb_render/)
- 覆盖所有驱动骨架且至少运行5帧的动画片段,共10,355个(资产仓库
animations.csv中16,190行中的一部分,其余仅驱动非关节节点或片段过短)。 - 每个片段一个文件夹,命名格式为
{glb stem}-{action},内含四个视角的MP4文件(前、后、左、右)。 - 使用Blender EEVEE引擎渲染,512×512分辨率,30 fps,水平仰角0°,H.264编码,透明帧平整至浅灰色背景。
- 渲染覆盖片段前200帧(约6.7秒);2,150个超过此长度的片段会被截断,JSON文件中的
frame_start/frame_end记录实际覆盖范围。 - 每个视角配有一个JSON文件,包含NeRF约定的相机参数(方位角/仰角、分辨率、水平视场角、4×4相机到世界变换矩阵等)以及场景归一化参数。
静止姿态网格(tpose/)
tpose/<stem>.png为 1024×1024 的2×2网格图,从GLB中渲染资产静止姿态的前、后、左、右视图。- 曾存放于资产仓库,后迁移至此,便于无需导入即可对资产的骨架类型进行分类。
使用方法
可通过 huggingface_hub 的 snapshot_download 按需下载特定文件,例如仅下载静止姿态网格或单独片段的四视角视频。
应用场景
渲染结果用于 UniMate/data_process 开放流程中的描述生成与骨架分类阶段,该流程将配套资产生成仓库转化为处理后的运动数据集 UniML3D。
许可与版权
- 渲染内容描绘第三方资产,无统一许可证覆盖,每个渲染继承被展示资产的原始上游许可。
- 使用或再分发前需通过Objaverse-XL注释查询对应
object_id的许可信息,完整声明与移除流程详见资产仓库中的NOTICE.md。 - 权利持有人可通过任一仓库提交问题以请求移除资产。
引用
该数据集是 UniML3D 训练语料库的一部分,来源论文为 UniMate: One Unified Model to Animate Diverse Skeletons(SIGGRAPH Asia 2026),引用详情见数据集页面提供的BibTeX条目。





