遇见数据集

Mixamo-Animations-Characters

收藏
Hugging Face2026-09-07 更新2026-09-08 收录
官方服务:

资源简介:

该数据集是 Adobe Mixamo 库的完整快照,包含 2,317 个运动动画剪辑和 114 个绑定角色,均以二进制 FBX 格式(FBX 7.7)提供。所有动画共享统一的 65 关节 mixamorig 骨架,可直接驱动任何兼容角色而无需重新映射。数据集包含多个子集:animation_motion(仅包含实际运动的 2,317 个剪辑)、animation(完整 2,446 个剪辑,含 129 个静态姿势)、character_refined(标准化骨骼命名空间的 114 个角色)、character_refined_glb(GLB 格式角色)、character_tpose(角色 T-pose 渲染图)、animation_motion_ybot(在 Y Bot 角色上烘焙的动画,包含网格和运动)、animation_motion_render(每个剪辑的四视图渲染 MP4 视频)。此外,还提供 JSON 索引文件(包含文本标签、Mixamo ID、帧数等)和 CSV 表格(metadata.csv 和 characters.csv),便于浏览和加载。数据集适用于文本到3D 动画、动作重定向、角色动画生成等研究任务。该数据集是 UniML3D 训练语料的一部分,用于 UniMate 模型(SIGGRAPH Asia 2026)。使用本数据集需遵守 Adobe Mixamo 条款。

This dataset is a complete snapshot of the Adobe Mixamo library, containing 2,317 motion animation clips and 114 rigged characters, all provided in binary FBX format (FBX 7.7). All animations share a unified 65-joint mixamorig skeleton, which can directly drive any compatible character without remapping. The dataset includes multiple subsets: animation_motion (2,317 clips with actual motion), animation (2,446 clips including 129 static poses), character_refined (114 characters with standardized bone namespaces), character_refined_glb (GLB format characters), character_tpose (T-pose renderings of characters), animation_motion_ybot (animations baked on the Y Bot character with meshes and motion), and animation_motion_render (four-view rendered MP4 videos for each clip). Additionally, JSON index files (containing text labels, Mixamo IDs, frame counts, etc.) and CSV tables (metadata.csv and characters.csv) are provided for easy browsing and loading. The dataset is suitable for research tasks such as text-to-3D animation, motion retargeting, and character animation generation. It is part of the UniML3D training corpus and used for the UniMate model (SIGGRAPH Asia 2026). Usage of this dataset must comply with the Adobe Mixamo terms.

创建时间:
2026-08-24
原始信息汇总

Mixamo Animations and Characters 数据集详情

数据集概览

该数据集是 Adobe Mixamo 库的完整快照,包含 2,317 个动画片段114 个绑定角色,以二进制 FBX(FBX 7.7)格式导出并提供逐文件元数据。所有动画共享统一的 65 关节 mixamorig 骨架,任何片段可直接驱动兼容角色而无需重新映射。

数据规模与许可

  • 规模: 1K < n < 10K 样本
  • 许可: Adobe Mixamo 条款(非标准许可)
  • 任务类型: text-to-3d(文本到三维)

数据集结构

核心目录

目录 内容 数量 说明
animation_motion/ 含运动的 FBX 动画 2,317 ✅ 推荐使用
animation/ 全部导出的动画(含静态姿势) 2,446 包含 129 个静态姿势文件
character_refined/ 标准化骨骼命名空间后的角色 114 ✅ 推荐使用
character/ 原始导出的角色 114 27 个角色存在编号化骨骼问题
character_refined_glb/ 角色 GLB 格式 114 转换自 character_refined/
character_tpose/ 角色 T-pose PNG 渲染图 114 1024×1024 四视图网格
animation_motion_ybot/ 烘焙到 Y Bot 上的动画 2,317 每个文件含网格+动画,约 3 MB
animation_motion_render/ 动画四视图渲染 2,317 目录 每个片段 4 个 MP4 + 相机 JSON

索引文件

  • animation_motion_prompts.json: 文件名 -> 文本标签 + Mixamo ID(2,317 条)
  • animation_motion_frames.json: 文件名 -> 关键帧数(2,317 条)
  • animation_prompts.json: 全部 2,446 个动画的标签映射
  • animation_frames.json: 全部 2,446 个动画的帧数映射
  • animation_bones.json: 所有动画共用的 65 个骨骼名称
  • characters.json: 文件名 -> 角色名称 + UUID
  • character_bones.json: 每个角色的骨骼列表
  • character_bone_fix_applied.txt: 27 个被重命名骨骼的角色
  • character_nonstandard_rig.txt: 4 个非标准命名角色
  • static_clips.csv: 129 个静态片段的测量说明
  • metadata.csv: 2,446 个动画的可浏览索引
  • characters.csv: 114 个角色的可浏览索引
  • scripts/: 下载、索引、归一化及验证代码

动画详情

基本特征

  • 格式: 二进制 FBX 7.7,30 fps,仅含骨架和动画曲线(无网格)
  • 骨架: 每个片段均为统一 65 关节 mixamorig 骨架(hips/spine/neck/head 链 + 双臂四关节手指 + 双腿含脚趾)
  • 时长: 8 – 1,884 关键帧
  • 命名: 按动作命名,同名的不同动作带数字后缀(如 Waving.fbxWaving_2.fbx

静态片段筛选

129 个静态姿势文件通过解码动画曲线并测量峰值-峰值范围来识别(而非依据文件名)。最大静态读数 0.024,最小运动读数 1.115,两者间无重叠,划分无歧义。安静的呼吸待机动画被保留。

角色详情

  • 数量: 114 个角色,T-pose,带蒙皮网格和材质
  • 骨骼规模: 37 – 112 骨骼

重定向兼容性

类别 数量 说明
覆盖全部 65 个动画骨骼 97 / 114 可直接重定向
简化 mixamorig 骨骼 13 37–64 骨骼,通常缺少手指关节;重定向可用,缺失骨骼无数据
不同骨骼命名 4 3 个使用标准名称但前缀不同;Aiden 使用 3ds Max Biped 命名

渲染预览

每个动画片段使用 Y Bot 角色、Blender EEVEE 引擎在 512×512、30 fps、0° 仰角下四视角渲染:

  • v000.mp4: 正面(方位角 -90°)
  • v001.mp4: 背面(方位角 +90°)
  • v002.mp4: 左面(方位角 180°)
  • v003.mp4: 右面(方位角 0°)

渲染覆盖片段前 200 帧(约 6.7 秒),2,317 个片段中有 375 个更长并被截断,JSON 文件记录实际覆盖范围。每个 JSON 文件按 NeRF 约定存储相机参数:viewazimuth/elevation(弧度)、resolutioncamera_angle_x(水平视场角)、4×4 transform_matrixscene_scale/scene_offset 以及 frame_start/frame_end/fps

已知限制

  • 62 个片段无 description;其中 23 个与其他片段共享相同的 prompt,无法仅靠文本区分
  • 即使优先使用 description,仍有 341 个片段与其他片段共享标签
  • animation_motion_prompts.json 中,Female/Male 风格前缀和 Sequence - 标记已从 prompt/description 中移除(属于动画风格描述而非动作语义);原始标签保留在 animation_prompts.jsonmetadata.csv 及文件名中
  • Mixamo MotionPack 捆绑包未包含(其子片段已单独收录)

数据来源与处理

数据通过 Mixamo 官方导出 API 导出(动画 skin=false,角色 skin=true),并重定向到标准 Y Bot 骨架。每个 FBX 均验证无截断,所有索引键与文件对应。该数据集为 UniML3D 的原始层,配套下游处理管线在 UniMate/data_process 开源,包括:NPZ 导出、预览渲染、视觉-语言模型标注、关节标签清理及训练特征提取。

引用信息

该数据集是 UniML3D 训练语料库的一部分,源自论文 UniMate: One Unified Model to Animate Diverse Skeletons(SIGGRAPH Asia 2026,arXiv:2609.05415)。使用需同时引用论文与数据集仓库。

搜集汇总
数据集介绍
Mixamo-Animations-Characters 数据集图片
构建方式
该数据集是Adobe Mixamo库的完整快照,包含2,317个运动片段和114个绑定角色,均以二进制FBX格式(版本7.7)导出。所有动画共享统一的65关节'mixamorig'骨架,确保了跨角色的直接驱动能力。数据集构建过程中,通过解码每一段动画曲线并测量其峰峰值范围,精确剔除了129个无运动姿态文件,使运动子集与静态姿态子集界限分明。同时,对角色文件实施了骨骼命名空间规范化(如将'mixamorig1:'修正为'mixamorig:'),并提供了GLB格式转换及多视角渲染预览,形成了一套结构清晰、严格校验的预处理流程。
使用方法
使用时,可通过HuggingFace Datasets库便捷加载,如加载'animation'和'character'配置。对于文本驱动的运动生成任务,推荐结合'animation_motion_prompts.json'中的描述标签进行筛选;如需动画与网格结合的场景,可直接使用'animation_motion_ybot'中的烘焙FBX文件,无需重定向。角色若需直接驱动,应选用'character_refined'目录下的规范化版本。数据集的原始处理流程已在UniMate的data_process脚本中开放,用户可参考脚本进行NPZ导出与特征提取,或直接运用提供的关键帧数JSON进行时长筛选,便捷地嵌入到Blender等三维软件中实现动画重定向。
背景与挑战
背景概述
Mixamo-Animations-Characters数据集由普林斯顿大学与Adobe研究团队于2026年构建,作为UniMate项目(SIGGRAPH Asia 2026)的核心数据基础,旨在解决文本到三维动画生成中数据稀缺与异构性问题。该数据集系统性地捕获了Adobe Mixamo平台全量资源,包含2,317段运动片段与114个绑定的卡通角色,所有动画统一采用65关节的mixamorig骨骼结构,确保了跨角色重定向的兼容性。其创建解决了三维动画领域长期缺乏大规模、标准化、可复现训练语料的困境,为多骨骼动画合成、文本驱动动作生成等研究方向提供了关键支撑,对推动统一动画模型的发展具有里程碑意义。
当前挑战
该数据集面临多重挑战。领域层面,文本到三维动画生成需克服动作语义与自然语言描述间的鸿沟,Mixamo原始标签存在缩写、风格前缀等噪声,且约23段剪辑共享相同文本提示,难以区分;骨骼结构各异(37至112关节)及命名空间不一致(27个角色需修正)增加了跨角色迁移的复杂性。构建层面,需剔除129个静态姿势文件(如T-Pose),确保数据纯粹性;处理FBX二进制格式的解析与统一,包括骨骼命名空间的重写及验证;渲染4,317个多视角视频需高效计算资源;同时需严格遵循Adobe Mixamo使用条款,确保数据发布合规性。
常用场景
经典使用场景
Mixamo-Animations-Characters数据集作为计算机图形学与三维动画研究领域的基石性资源,其经典使用场景集中于骨骼动画的合成、重定向及角色绑定等核心任务。该数据集收录了2,317段具备真实运动的动作片段与114个精细绑定的三维角色,所有动作均统一采用65关节的mixamorig骨架,使得跨角色动作迁移无需繁复的骨骼映射。研究者既可将其作为大规模运动数据的基准,用于动作生成模型的训练与评测,亦可借助其整齐的元数据索引与渲染预览,开展文本到运动检索、动作识别等交叉领域探索,其即插即用的FBX格式亦为传统动画制作流程提供了高效支撑。
解决学术问题
在学术研究层面,该数据集有效回应了三维动画数据获取成本高、格式异构与标注匮乏等长期痛点。通过提供统一骨架下的海量动作剪辑与角色模型,它解决了动作重定向中因骨骼命名空间不一致而导致的隐性失败问题,其精炼后的角色库与静态动作甄别方案为数据可靠性建立了新标杆。此外,文本标注与动作一一对应的结构为文本驱动动作生成等前沿课题提供了高质量监督信号,显著缓解了真实动捕数据稀缺的困境,其严谨的处理流程与校验脚本亦为数据集构建范式贡献了可复现的经验。
实际应用
于实际应用维度,该数据集的价值在游戏开发、影视特效与虚拟人技术等产业场景中尤为凸显。开发者可借助其即用型角色与动作资产,快速构建逼真的虚拟角色动画系统,从普通的角色行走、交互到复杂的战斗连招皆可灵活调用。动画师在Blender等数字内容创作工具中通过简单的导入操作即可将动作绑定至任意兼容角色,大幅缩减手工调校的成本与周期。该数据集附带的渲染视频与相机参数,还为神经辐射场等三维重建与新型视图合成技术提供了标准化的多视角评测素材,推动了沉浸式媒体制作流程的智能化升级。
数据集最近研究
最新研究方向
在三维动画与虚拟角色合成的前沿探索中,Mixamo-Animations-Characters数据集以其庞大的运动捕捉资源与统一的角色骨架结构,为文本驱动的人体动作生成及跨骨架重定向研究提供了关键基石。该数据集整合了2317段动态剪辑与114个精细绑定角色,每段动画共享一致的65关节mixamorig骨骼体系,极大简化了动作与角色间的适配流程,为多模态运动合成模型的训练与评估设定了全新基准。其配套的UniML3D处理管线进一步将原始FBX数据转化为规范化的文本-运动对,借助视觉语言模型实现自动标注,推动了从语义描述到细腻动作的生成范式演进。此数据集尤其适用于研究动作语义解耦、风格迁移及角色泛化等核心问题,对数字人、游戏动画及沉浸式交互领域的发展具有显著推动作用。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务