DH-FaceVid-1K
收藏资源简介:
DH-FaceVid-1K是一个大规模高质量的面部视频生成数据集,包含270,043个视频剪辑以及相应的音频和注释,涵盖超过20,000个独特身份和超过1,200小时的面部视频素材,拍摄于各种环境条件和光照场景。值得注意的是,83%的数据集代表亚洲个体,解决了开源亚洲面部视频数据集的显著短缺问题。
DH-FaceVid-1K is a large-scale, high-quality facial video generation dataset containing 270,043 video clips along with corresponding audio and annotations. It encompasses over 20,000 unique identities and more than 1,200 hours of facial video material, captured under various environmental conditions and lighting scenarios. Notably, 83% of the dataset represents Asian individuals, addressing the significant shortage of open-source Asian facial video datasets.
DH-FaceVid-1K 数据集概述
基本信息
- 数据集名称: DH-FaceVid-1K
- 会议/期刊: ICCV 2025
- 论文链接: https://arxiv.org/abs/2410.07151
- 项目网站: https://dh-facevid-1k.github.io/DH-FaceVid-1K/
- 数据集版本: v1.0
- 数据集申请链接: https://forms.gle/vEyouWdS9CgcRFMt9
- 许可证链接: https://github.com/DH-FaceVid-1K/DH-FaceVid-1K/blob/main/LICENSE
数据集详情
- 数据规模: 270,043个视频片段
- 时长: 超过1,200小时
- 数据量: 约4.01 TB
- 分辨率: 视频样本调整为256×256分辨率
- 唯一身份数: 超过20,000个
- 主要种族: 83%为亚洲人
数据内容
- 包含内容:
- 视频片段
- 对应的语音音频
- 面部关键点
- 文本注释
- 属性标注:
- 种族
- 外观细节
- 情绪
- 动作
- 光照条件
数据集特点
- 多样性: 多种族覆盖
- 高质量: 全面的个体属性标注
- 应用场景: 支持文本到视频和图像到视频生成等任务
引用信息
bibtex @inproceedings{Di2024FaceVid1KAL, title={FaceVid-1K: A Large-Scale High-Quality Multiracial Human Face Video Dataset}, author={Donglin Di and He Feng and Wenzhang Sun and Yongjia Ma and Hao Li and Wei Chen and Xiaofei Gou and Tonghua Su and Xun Yang}, year={2024}, url={https://api.semanticscholar.org/CorpusID:273233717} }
注意事项
- 数据使用: 必须遵守相关许可协议
- 申请流程: 需提交信息审核,审核通过后1-2天内发送下载说明
- 联系方式: fenghe021209@gmail.com




