mountain-village-unreal-synthetic
收藏资源简介:
这是一个名为“山间村庄:虚幻引擎合成检测捕获”的合成数据集。数据集由单个Unreal Engine环境渲染的300帧图像组成,共包含5,892个标注对象实例。所有边界框和实例分割掩码均直接从引擎的逐实例ID缓冲区读取,无需模型预测或人工标注,因此标签错误仅可能源于场景描述本身的错误。数据集包含5个类别:人(2,470个实例)、桶(1,742个)、盒子(626个)、拖拉机(132个)和手推车(922个)。图像分辨率为1280×960,水平视场角57.3度,相机策略为“camera_zones_look_at_target”,使用3个作者定义的区域。数据集的布局包括:images/(RGB图像,PNG格式)、segmentation/(逐实例ID缓冲区,每个实例一种颜色)、labels/(YOLO格式边界框,每帧一个文本文件)、annotations/(COCO格式标签)、metadata/(每帧的相机、角色和生成记录)、reports/(验证输出)以及capture.json和data.yaml配置文件。所有300帧未划分固定数据集,可根据实验需求自行分割。质量验证显示:0张损坏图像,0帧无标签,0张近似重复图像,0个跨分割泄漏,平均亮度95.2,仅有2帧欠曝光。已知限制包括:类别不平衡(最稀有/最常见类别比率为0.053)、视角和距离覆盖范围较窄(仅来自3个作者区域)、合成到真实的域差距(建议作为预训练或增强材料,而非真实评估集的替代)。数据集适用于目标检测和实例分割任务,尤其适合sim2real场景下的预训练或数据增强。
This is a synthetic dataset named Mountain Village: Unreal Engine Synthetic Detection and Capture. It consists of 300 frames rendered from a single Unreal Engine environment, containing a total of 5,892 annotated object instances. All bounding boxes and instance segmentation masks are directly read from the engines per-instance ID buffer without model prediction or manual annotation, so label errors can only originate from errors in the scene description itself. The dataset includes 5 categories: person (2,470 instances), barrel (1,742), box (626), tractor (132), and cart (922). The image resolution is 1280×960, with a horizontal field of view of 57.3 degrees, and the camera strategy is camera_zones_look_at_target using 3 author-defined zones. The dataset layout includes: images/ (RGB images, PNG format), segmentation/ (per-instance ID buffer, one color per instance), labels/ (YOLO format bounding boxes, one text file per frame), annotations/ (COCO format labels), metadata/ (camera, actor, and generation records per frame), reports/ (validation outputs), and configuration files capture.json and data.yaml. All 300 frames are not split into fixed datasets; users can split them according to experimental needs. Quality validation shows: 0 corrupted images, 0 frames without labels, 0 near-duplicate images, 0 cross-split leaks, average brightness 95.2, only 2 underexposed frames. Known limitations include: class imbalance (ratio of rarest to most common class is 0.053), narrow coverage of viewpoints and distances (only from 3 author zones), and synthetic-to-real domain gap (recommended as pre-training or augmentation material, not a substitute for real evaluation sets). The dataset is suitable for object detection and instance segmentation tasks, especially for pre-training or data augmentation in sim2real scenarios.
数据集概述
Mountain village: Unreal Engine synthetic capture 是一个由 Unreal Engine 渲染生成的合成图像数据集,专为目标检测和图像分割任务设计。数据集包含 300 帧来自单一 Unreal Engine 环境的渲染图像,共标注 5,892 个对象实例,所有标注均由引擎的逐实例 ID 缓冲区自动生成,无人工标注。
基本信息
| 属性 | 值 |
|---|---|
| 引擎版本 | Unreal Engine 5.8.1 |
| 地图 | MV_Map_Demo_1 |
| 帧数 | 300 |
| 实例总数 | 5,892 |
| 分辨率 | 1280 x 960 |
| 水平视场角 | 57.3 度 |
| 相机策略 | camera_zones_look_at_target,3 个预设区域 |
| 镜头配置 | realistic_drone at 0.6 |
| 时间范围 | 07:00 至 19:00 |
| 天气 | 场景天气(300 帧固定) |
| 主种子 | 20260817 |
| 验证评分 | A 级,92.4 / 100 |
可复现性:对象位置、姿态和相机位姿由主种子确定性采样(deterministic_per_logical_frame_and_instance),相同种子和场景可复现完全相同的 300 帧。
类别分布
| 类别 ID | 类别名称 | 实例数量 |
|---|---|---|
| 0 | person | 2,470 |
| 1 | barrel | 1,742 |
| 2 | box | 626 |
| 3 | tractor | 132 |
| 4 | wheelbarrow | 922 |
按 COCO 尺度阈值分类:小目标 4,696 个、中目标 1,125 个、大目标 71 个。平均边界框覆盖画面约 0.08%,属于小目标检测数据集。
文件结构
images/ 渲染 RGB 帧,未修改的 PNG segmentation/ 逐实例 ID 缓冲区,每个实例一种颜色 labels/ YOLO 格式边界框,每帧一个文本文件 annotations/ COCO 格式标注 metadata/ 每帧相机、Actor 和生成清单记录 reports/ 验证输出报告 capture.json 运行契约(类别、相机策略、种子) data.yaml 类别名称,可直接用于 YOLO 训练
同帧在 images/、segmentation/、labels/ 和 metadata/ 中一致对应。未预设训练/验证/测试划分,全部 300 帧置于同一数据池,可按需自行分割。
注意:解码 segmentation/*.png 时需使用尊重文件声明的通道顺序的库。实例颜色为精确 8 位值,通道顺序错误会导致掩码读取为空。
质量控制结果
来源:reports/validation.json
- 损坏图像:0 / 300
- 无标注帧:0
- 近似重复图像:0
- 跨划分泄漏:0
- 平均亮度 95.2;欠曝帧 2 个,过曝帧 0 个
- 逐帧核对:300 帧请求、300 张图像、300 个标注文件、5,892 条标注全部一致
已知局限
- 类别不平衡扣分 7.57 分:最稀有类别与最常见类别比例为 0.053
build-provenance检查未通过:BUILD_PROVENANCE_UNVERIFIED: UNVERIFIED_REPOSITORY_COMMIT- 引擎可见人物中约 2/2325(0.09%,涉及 300/300 帧)未被标注
- 相机位姿仅覆盖 3 个预设区域及较窄的视角和距离范围
- 渲染图像存在合成到真实的域差距,适合作为预训练或增强材料,不宜替代真实评测集
来源与条款
- 图像由 Unreal Engine 渲染并在 NameFrameCapture(编辑器插件)中从引擎实例缓冲区生成标注
capture.json包含完整构建记录(插件哈希、任务哈希及未验证的检查项)- 场景中的环境和道具资产由第三方许可,仅限 Unreal Engine 项目内使用
- 本数据集仅发布渲染图像和标注,不包含源码资产、
.uasset或地图文件 - 重新分发图像前须阅读
LICENSE条款 - 许可类型:
other(sample-capture-terms) - 详细管道及更多环境文档:https://getnameframe.com




