遇见数据集

Exercises Dataset — 中文增强版

收藏
github2026-07-20 更新2026-07-31 收录
官方服务:

资源简介:

包含1,324个健身动作的综合数据集,每个动作配有动画GIF、180×180缩略图、肌肉群与器械分类、以及10种语言的步骤说明(英文、西班牙文、意大利文、土耳其文、俄文、中文、印地文、波兰文、韩文、法文)。

A comprehensive dataset containing 1,324 fitness movements, with each movement accompanied by animated GIFs, 180×180 thumbnails, muscle group and equipment classifications, as well as step-by-step instructions in 10 languages: English, Spanish, Italian, Turkish, Russian, Chinese, Hindi, Polish, Korean, and French.

创建时间:
2026-07-20
原始信息汇总

📊 数据集概览

Exercises Dataset — 中文增强版 是一个包含 1,324 个健身动作的综合数据集,每个动作配有动画 GIF、180×180 缩略图、肌肉群与器械分类,以及 10 种语言的步骤说明(英文、西班牙文、意大利文、土耳其文、俄文、中文、印地文、波兰文、韩文、法文)。


🆚 与原始项目的区别

本数据集是 hasaneyldrm/exercises-dataset 的 Fork 增强版本,主要差异包括:

特性 原始仓库 本仓库
images/ 目录 (1,324 张缩略图) 因版权争议移除 ✅ 保留
videos/ 目录 (1,324 个动画 GIF) 因版权争议移除 ✅ 保留
exercises.jsonimage/gif_url 字段 置为 null ✅ 保留原始路径
界面语言 英文 ✅ 全中文界面
中文动作名翻译 ✅ 1,319 个动作名中文翻译

📂 文件结构

exercises-dataset/ ├── data/ │ ├── exercises.json # 完整数据集 — 1,324 条动作记录 │ ├── exercises.schema.json # JSON Schema (2020-12) 用于验证 │ ├── name_zh.json # 中文动作名映射 (JSON 格式) │ └── name_zh.js # 中文动作名映射 (JS 全局变量) ├── images/ # 1,324 × 180×180 缩略图 ├── videos/ # 1,324 × 180×180 动画 GIF ├── index.html # 中文动作库浏览器 ├── setup.html # 中文开发者设置向导 ├── all_names.txt # 全部动作英文名列表 ├── build_zh.js # 中文翻译生成脚本 ├── NOTICE.md # 媒体版权归属说明 ├── DIFFERENCES.md # 与原始项目的详细差异 ├── LICENSE └── README.md


📊 统计数据

指标 数量
总动作数 1,324
说明语言数 10
中文动作名翻译 1,319
动画 GIF 1,324
缩略图 1,324

🧠 按身体部位分类

身体部位 动作数量
上臂 (Upper Arms) 292
大腿 (Upper Legs) 227
背部 (Back) 203
腰部 (Waist) 169
胸部 (Chest) 163
肩部 (Shoulders) 143
小腿 (Lower Legs) 59
前臂 (Lower Arms) 37
有氧 (Cardio) 29
颈部 (Neck) 2

🏋️ 按器械分类

器械 动作数量
自重 (Body Weight) 325
哑铃 (Dumbbell) 294
绳索 (Cable) 157
杠铃 (Barbell) 154
杠杆机 (Leverage Machine) 81
弹力带 (Band) 54
史密斯机 (Smith Machine) 48
壶铃 (Kettlebell) 41
负重 (Weighted) 36
稳定球 (Stability Ball) 28
曲杠 (EZ Barbell) 23
其他 83

🗂️ 数据 Schema

data/exercises.json 中每条记录包含以下字段:

字段 类型 说明
id string 唯一数字 ID(如 "0001"
name string 完整动作名称
category string 身体部位分类
body_part string 目标身体部位
equipment string 所需器械
instructions.en ~ instructions.fr string 10 种语言的完整步骤说明
instruction_steps.<lang> array[string] 分步说明数组,每种语言
muscle_group string 主要协同肌肉群
secondary_muscles array[string] 其他参与的肌肉
target string 主要目标肌肉
media_id string 原始媒体引用 ID
image string 180×180 缩略图路径
gif_url string 180×180 动画 GIF 路径
attribution string 媒体版权声明
created_at string ISO 8601 时间戳

🖥️ 交互式工具

  • index.html — 全中文动作库浏览器,支持搜索、按分类/器械/目标肌肉筛选、无限滚动网格布局、10 种语言说明切换
  • setup.html — 开发者设置向导,支持生成 SQL Server、PostgreSQL、MySQL 和 SQLite 的建表与插入语句,提供多种编程语言的 API 集成代码示例,以及可直接用于 LLM 的 REST API 生成提示词

🀄 中文动作名翻译

  • name_zh.json — 键为英文动作名,值为中文翻译
  • name_zh.js — 与 JSON 内容相同,以 window.NAME_ZH 全局变量形式提供,可在浏览器中直接引用
  • build_zh.js — 中文翻译生成脚本,从 all_names.txt 读取全部英文动作名,通过术语组合逻辑生成翻译

翻译策略

  • 固定词组直译(如 "barbell" → "杠铃")
  • 身体部位翻译(如 "biceps" → "肱二头肌")
  • 动作类型翻译(如 "curl" → "弯举")
  • 方向/姿态翻译(如 "incline" → "上斜")
  • 复合名称按中文语序组合

当前翻译覆盖率为 99.6%(1,319/1,324)。


📜 License 与版权

  • 代码、工具、数据集结构、说明文字:MIT License
  • 动作演示媒体(图片 & GIF):© Gym visual,经授权以 180×180 分辨率分发,使用需保留版权声明并遵守 Gym visual 条款
  • 中文动作名翻译:MIT License
  • 本仓库不主张对底层动作内容或媒体的所有权

🔍 适用场景

  • 构建健身或训练计划应用
  • 涉及动作识别或推荐的机器学习项目
  • 健康与健身研究
  • 教育演示和原型开发

📦 数据来源

数据源自 ExerciseDB v1 by AscendAPI,通过 Kaggle 重新分发。原始数据集基于 hasaneyldrm/exercises-dataset

搜集汇总
数据集介绍
Exercises Dataset — 中文增强版 数据集图片
构建方式
该数据集源于ExerciseDB v1,经Kaggle重新分发后,由开发者基于原始仓库进行中文增强构建。构建过程中,保留原始1,324个健身动作的完整元数据,包括动作名称、分类、目标肌肉、器械类型及多语言分步说明,并修复了原版因版权争议移除的媒体文件,补充了1,324张180×180缩略图与动画GIF。同时,新增1,319个动作名的中文翻译,通过术语组合策略生成,并配套开发了中文化的交互式浏览器和开发者设置向导,使数据集的可用性与本地化程度大幅提升。
特点
该数据集集成了覆盖全身十类身体部位、十三种器械类型的多样化动作库,其核心特色在于多模态与多语言的深度融合:每项动作均配置动画演示与静态缩略图,辅以十种语言的分步指导,极大便利了跨文化教学与人工智能辅助训练系统的开发。尤为突出的是,数据集中包含完整的中文动作名映射与全中文界面工具,显著降低了中文用户的使用门槛。此外,该数据集附有标准JSON Schema和多种编程语言的调用示例,兼顾了学术研究的严谨性与工程实践的便捷性。
使用方法
使用该数据集时,可直接通过Python或JavaScript加载核心JSON文件,依据字段如‘category’、‘equipment’进行灵活筛选,快速提取特定部位或器械的动作集。内置的‘name_zh.json’映射文件支持英文名与中文名的无缝转换,便于中文应用集成。开发者可借助浏览器直接打开‘index.html’进行可视化检索,或利用‘setup.html’向导一键生成多数据库建表语句及多种语言的API调用代码,亦可将结构化提示词输入至大语言模型以自动生成REST API服务,实现从数据浏览到应用部署的全流程支持。
背景与挑战
背景概述
在计算机视觉与运动科学交叉领域,动作识别与健身指导的智能化需求日益凸显,而高质量、多模态的健身动作数据集正是支撑相关算法训练与评估的基石。Exercises Dataset — 中文增强版由社区开发者基于hasaneyldrm/exercises-dataset进行Fork扩展,后者源自AscendAPI的ExerciseDB v1。该数据集收录1,324个健身动作,涵盖10种身体部位分类与13类器械,每个动作均配有动画GIF、缩略图及10种语言的步骤说明。其核心研究问题在于构建一个结构化的、多语言友好的健身动作基准,以支持动作识别模型、训练计划生成及健康研究。该数据集因提供完整媒体文件与中文化界面而显著增强了原版的实用性与可访问性,为中文用户及研究者提供了便捷的工具,对健身AI领域的数据生态建设具有积极推动作用。
当前挑战
该数据集在构建与应用中面临多重挑战。首先,原始数据集因版权争议移除了关键媒体文件,本增强版虽予以保留,但媒体内容仍受Gym visual条款约束,二次使用需自行获取授权,这为数据集的合法分发与大规模商用设置了障碍。其次,中文动作名翻译仅覆盖1,319/1,324个动作,尚有5个未译,且翻译采用术语组合策略,对于复合动作或俚语名称的准确度有限,可能影响多语言场景下的语义一致性。此外,数据集的标注结构虽较为完善,但缺乏动作难度、关节角度等细粒度信息,限制了在高精度姿态估计或运动分析任务中的直接应用。最后,多语言说明的生成与质量校验依赖人工,随着动作库扩展,维护成本将显著增加。
常用场景
经典使用场景
Exercises Dataset — 中文增强版作为一项涵盖1,324个健身动作的综合性语料资源,其经典使用场景集中于动作识别与推荐系统的研发。数据集为每个动作提供了动画GIF、180×180缩略图、肌肉群分类、器械类型以及十种语言的逐步说明,为计算机视觉模型的动作理解与姿态估计提供了标准化训练样本。研究者可借助该数据集构建多模态动作识别算法,结合文本指令与视觉表征进行跨模态学习。此外,数据集的细粒度标签体系(如目标肌肉、协同肌肉、器械类型)支持基于内容的动作检索与个性化训练方案生成,成为体育科学与人机交互领域验证算法性能的基准平台。
衍生相关工作
该数据集的衍生工作已辐射多个前沿研究方向。基于其结构化JSON数据,研究者相继开发了动作推荐系统、训练计划自动生成算法及基于大语言模型的健身对话智能体。在视觉领域,利用GIF序列开展人体姿态估计与动作质量评估的模型训练,推动了无监督动作分割和跨视角动作识别的发展。多语言指令与中文动作名的映射关系,促使了健身知识库的跨语言对齐研究,并衍生出多模态检索工具。此外,其Schema定义被多篇论文引用为健身数据标准化的参考模板,促进了异构运动数据的互操作规范,为可穿戴设备动作标签统一提供了可行路径。
数据集最近研究
最新研究方向
基于多模态健身动作数据集的智能健身与运动分析研究正成为健康计算领域的前沿热点。该中文增强版数据集凭借其丰富的动作分类、多语言指令及可视化媒体资源,为动作识别、姿态估计、个性化训练推荐等计算机视觉与机器学习任务提供了坚实的数据基石。其涵盖的广泛器械类型与肌肉群映射,亦为运动生物力学建模和跨文化运动指导的适配研究开辟了新径,在智能健身设备、康复训练辅助及运动科学数字化进程中具有重要的推动价值。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务