Project AI❤dol Public English Dataset
收藏资源简介:
由于公开的英语SVS数据严重缺乏,由女性歌手演唱的数据集尤为稀缺,因此决定发布自己的语料库。该数据集是完整数据集的一个精选,仅包含英语歌曲,并选择了最佳的演唱数据。标签仅使用默认的Arpabet音素。声音提供者不是英语母语者,但发音应该足够好。她也不是专业歌手,但演唱质量仍然可以接受。数据总时长为1小时45分钟。
Given the severe scarcity of publicly available English SVS datasets, especially those sung by female vocalists, we decided to release our own corpus. This dataset is a curated subset of the full dataset, which only includes English songs and retains only the highest-quality vocal performances. The labels exclusively use the default Arpabet phonemes. The voice provider is not a native English speaker, but their pronunciation is sufficiently competent. She is also not a professional singer, but the quality of the vocal performances remains acceptable. The total duration of the dataset is 1 hour and 45 minutes.
Project AI❤dol Public English Dataset
概述
- 数据来源: 由Lotte V (或@lottev1991) 提供。
- 数据类型: 英语歌唱数据集。
- 数据质量:
- 语音提供者非英语母语者,但发音质量良好。
- 语音提供者非专业歌手,但歌唱质量尚可。
- 数据时长: 总时长为1小时45分钟。
- 标签格式: 使用默认的Arpabet音素标签。
使用条款
- 许可信息: 请参考
LICENSE文件获取更多信息。 - 署名要求: 使用数据集时,请正确署名Lotte V (或@lottev1991)。
- 允许用途:
- 用于研究目的。
- 发布自定义标签,需提供正确署名。
- 用于个人歌唱数据的标签,可能需要手动调整,需提供正确署名。
- 用于个人SVS模型的音高训练,需提供正确署名。
- 限制用途:
- 仅限并行训练使用,不允许发布包含此语音的公共模型。
- 禁止与语音变声器(如RVC等)一起使用。
- 禁止用于任何商业项目。
- 禁止用于任何非法目的。
- 禁止用于训练未经授权的语音(如名人声音等)。




