ConsisID-preview-Data
收藏资源简介:
这是一个用于文本到视频生成的数据集,旨在保持生成视频中的人物身份一致性。数据集包含部分开放源代码和权重。
This is a dataset for text-to-video generation, which aims to maintain the consistency of character identities in the generated videos. The dataset includes partial open-source code and model weights.
ConsisID 数据集概述
数据集描述
- 名称: ConsisID
- 类型: 文本到视频生成数据集
- 用途: 用于训练和评估身份保持的文本到视频生成模型
数据集下载
- 链接: HuggingFace
- 命令: bash huggingface-cli download --repo-type dataset BestWishYsh/ConsisID-preview-Data --local-dir BestWishYsh/ConsisID-preview-Data
数据集结构
-
数据格式:
📦 datasets/ ├── 📂 captions/ │ ├── 📄 dataname_1.json │ ├── 📄 dataname_2.json ├── 📂 dataname_1/ │ ├── 📂 refine_bbox_jsons/ │ ├── 📂 track_masks_data/ │ ├── 📂 videos/ ├── 📂 dataname_2/ │ ├── 📂 refine_bbox_jsons/ │ ├── 📂 track_masks_data/ │ ├── 📂 videos/ ├── ... ├── 📄 total_train_data.txt
数据集预览
- 示例: 可在项目页面查看部分样本
数据集处理
- 数据预处理代码: 即将发布
数据集使用
- 训练:
-
环境设置: bash git clone --depth=1 https://github.com/PKU-YuanGroup/ConsisID.git cd ConsisID conda create -n consisid python=3.11.0 conda activate consisid pip install -r requirements.txt
-
训练脚本: bash
For single rank
bash train_single_rank.sh
For multi rank
bash train_multi_rank.sh
-
许可证
- 许可证类型: Apache 2.0
- 许可证文件: LICENSE




