wolof_tts
收藏资源简介:
这是一个Wolof语言的文本到语音(TTS)数据集,由Baamtu Datamation收集,作为AI4D非洲语言项目的一部分。数据集包含来自两名母语为Wolof的说话者的录音,一男一女,每位说话者录制了超过20,000个句子。录音时间分别为男性22小时28分钟41秒和女性18小时47分钟19秒。文本数据来自新闻网站、维基百科和自定义文本。数据集在Zenodo上托管,并由GalsenAI通过HuggingFace平台提供,以加强塞内加尔的AI生态系统。
Wolof TTS 数据集概述
数据集描述
Wolof TTS 数据集是由 Baamtu Datamation 作为 AI4D African language program 的一部分收集的 Wolof 语言的文本到语音(TTS)数据集。该数据集最初托管在 Zenodo 上,包含两名母语为 Wolof 的发言人的录音(一名男性和一名女性)。每位发言者录制了超过 20,000 句话。
发言时间
- 男性:22小时28分钟41秒
- 女性:18小时47分钟19秒
文本数据来自新闻网站、维基百科和自定义文本。
数据集信息
- 特征:
audio:采样率为 16000text:字符串类型gender:字符串类型
- 分割:
train:包含 36009 个样本,大小为 4274917077.83 字节test:包含 4001 个样本,大小为 475541653.87 字节
- 下载大小:4571561616 字节
- 数据集大小:4750458731.7 字节
- 配置:
default:train:路径为data/train-*test:路径为data/test-*
- 许可:cc-by-4.0
- 任务类别:text-to-speech
- 语言:wo
- 名称:woloftts
- 大小类别:10K<n<100K
引用
如果您使用该数据集,请引用以下论文:
@dataset{thierno_ibrahima_diop_2021_4498861, author = {Thierno Ibrahima Diop and Demba AW and Ami jaane and Mamadou Badiane}, title = {WOLOF TTS(Text To Speech) Data}, month = feb, year = 2021, publisher = {Zenodo}, version = 1, doi = {10.5281/zenodo.4498861}, url = {https://doi.org/10.5281/zenodo.4498861} }




