SynthGait-19K
收藏资源简介:
SynthGait-19K 是一个包含 19,272 个合成行走视频的数据集,源自 6,427 个基础运动序列,每个序列最多从三个摄像机视角(正面、矢状面、随机)渲染。该数据集旨在支持基于视频的步态参数估计任务。数据以未压缩的 WebDataset TAR 分片形式发布(每片约 1 GB),每个样本包含一个 H.264 编码的 MP4 视频(分辨率 832×480,帧率 16 FPS)、一个 NPZ 格式的数值标注文件(包含六个步态特征:步频、步行速度、步长均值、步宽均值、驼背姿势均值、手臂摆动,以及左右脚跟触地索引)和一个 JSON 格式的元数据文件(包含样本 ID、划分、视角、视频属性、相机参数、步态特征等)。数据集划分为训练集(15,397 个视频)和验证集(3,875 个视频)。注意:脚跟触地索引基于 30 Hz 的标注时间线,而非视频帧索引。该数据集仅可用于非商业研究,禁止商业、生产、临床、诊断或患者护理用途。合成数据可能反映其运动来源和生成流程中的偏差或伪影,未经临床验证,不能替代临床数据或专业医疗判断。
SynthGait-19K is a dataset containing 19,272 synthetic walking videos derived from 6,427 base motion sequences, each rendered from up to three camera viewpoints (frontal, sagittal, random). It is designed to support video-based gait parameter estimation tasks. The data is released as uncompressed WebDataset TAR shards (approximately 1 GB per shard), with each sample containing an H.264 encoded MP4 video (resolution 832×480, frame rate 16 FPS), an NPZ format numerical annotation file (including six gait features: cadence, walking speed, mean step length, mean step width, mean stoop posture, arm swing, and left/right heel strike indices), and a JSON format metadata file (including sample ID, split, viewpoint, video properties, camera parameters, gait features, etc.). The dataset is split into training set (15,397 videos) and validation set (3,875 videos). Note: Heel strike indices are based on a 30 Hz annotation timeline, not video frame indices. This dataset is for non-commercial research only; commercial, production, clinical, diagnostic, or patient care uses are prohibited. Synthetic data may reflect biases or artifacts from its motion sources and generation pipeline, and has not been clinically validated; it cannot replace clinical data or professional medical judgment.
SynthGait-19K 数据集概述
SynthGait-19K 是一个用于基于视频的步态参数估计的合成数据集,共包含 19,272 段合成行走视频,来源于 6,427 个底层运动序列。每个运动序列从最多三个摄像机视角渲染(正面、矢状面、随机视角)。
数据集规模与划分
- 训练集:15,397 段视频(5,135 个行走序列)
- 验证集:3,875 段视频(1,292 个行走序列)
- 同一行走序列的所有视角被分配到同一数据划分中
- 视角统计:正面视角 6,425 段、矢状面视角 6,426 段、随机视角 6,421 段
数据结构与格式
数据集以 WebDataset TAR 分片格式发布,每个分片约 1 GB。每个样本包含:
- 视频文件:H.264 编码,分辨率 832x480,帧率 16 FPS
- NPZ 文件:数值注释(
features、left_heel_strikes、right_heel_strikes数组) - JSON 文件:元数据(样本 ID、划分、视角、视频属性、相机旋转与视野、步态特征、左右脚跟触地索引)
注意:脚跟触地索引对应 30 Hz 的注释时间线,而非视频帧索引(16 FPS)。
步态特征模式
数据集中包含六个输出目标,顺序如下:
| 字段 | 单位 | 含义 |
|---|---|---|
cadence |
steps/min | 步频 |
walking_speed |
m/s | 平均前进速度 |
step_length_mean |
m | 平均步长 |
step_width_mean |
m | 平均步宽 |
stoop_posture_mean |
ratio | 平均驼背姿势(C7 至 S1 前向偏移除以腿长) |
arm_swing |
ratio | 手臂摆动(腕部前向范围除以腿长) |
使用与加载方式
数据集的 TAR 分片文件名决定了数据划分(train-*.tar 对应训练集,validation-*.tar 对应验证集)。分片名称在发布时已固定,同一行走的所有视角保留在相同划分中。
支持以下加载方式:
- Hugging Face Datasets:可使用
load_datasetAPI 进行流式加载 - WebDataset:通过 WebDataset 库直接读取 TAR 分片 URL
- 缓存构建:配合 FoundationGait 仓库中的
cache_hf_dataset.py脚本构建训练缓存,脚本按名称读取六个目标特征,并使用人体检测器构建训练加载器所需的裁剪 32 帧张量
隐私与去标识化
行走序列在分配公共 vid_XXXXX 标识符前经过打乱处理,同一运动的不同视角共享同一基础标识符。发布数据不包含原始文件名、受试者标识符、来源数据集标签或私有映射文件。这些措施应视为假名化而非不可逆匿名化,持有源数据的机构可能通过运动或注释相似性进行记录匹配。
许可协议
SynthGait-19K 采用 SynthGait-19K 研究使用许可,仅允许非商业研究用途。商业、生产、临床、诊断及患者护理用途须先获得作者书面许可。该数据集未经临床验证,不能替代临床数据或专业医疗判断。




