Codec-SUPERB/noisy_vctk_16k_extract_unit
收藏资源简介:
--- configs: - config_name: default data_files: - split: academicodec_hifi_16k_320d path: data/academicodec_hifi_16k_320d-* - split: academicodec_hifi_16k_320d_large_uni path: data/academicodec_hifi_16k_320d_large_uni-* - split: academicodec_hifi_24k_320d path: data/academicodec_hifi_24k_320d-* - split: audiodec_24k_320d path: data/audiodec_24k_320d-* - split: dac_16k path: data/dac_16k-* - split: dac_24k path: data/dac_24k-* - split: dac_44k path: data/dac_44k-* - split: encodec_24k path: data/encodec_24k-* - split: funcodec_en_libritts_16k_gr1nq32ds320 path: data/funcodec_en_libritts_16k_gr1nq32ds320-* - split: funcodec_en_libritts_16k_gr8nq32ds320 path: data/funcodec_en_libritts_16k_gr8nq32ds320-* - split: funcodec_en_libritts_16k_nq32ds320 path: data/funcodec_en_libritts_16k_nq32ds320-* - split: funcodec_en_libritts_16k_nq32ds640 path: data/funcodec_en_libritts_16k_nq32ds640-* - split: funcodec_zh_en_16k_nq32ds320 path: data/funcodec_zh_en_16k_nq32ds320-* - split: funcodec_zh_en_16k_nq32ds640 path: data/funcodec_zh_en_16k_nq32ds640-* - split: speech_tokenizer_16k path: data/speech_tokenizer_16k-* dataset_info: features: - name: id dtype: string - name: unit sequence: sequence: int64 splits: - name: academicodec_hifi_16k_320d num_bytes: 116057288 num_examples: 24792 - name: academicodec_hifi_16k_320d_large_uni num_bytes: 116057288 num_examples: 24792 - name: academicodec_hifi_24k_320d num_bytes: 173451464 num_examples: 24792 - name: audiodec_24k_320d num_bytes: 370177480 num_examples: 24792 - name: dac_16k num_bytes: 743941448 num_examples: 24792 - name: dac_24k num_bytes: 2140233288 num_examples: 24792 - name: dac_44k num_bytes: 641562920 num_examples: 24792 - name: encodec_24k num_bytes: 87719016 num_examples: 24792 - name: funcodec_en_libritts_16k_gr1nq32ds320 num_bytes: 926382152 num_examples: 24792 - name: funcodec_en_libritts_16k_gr8nq32ds320 num_bytes: 926382152 num_examples: 24792 - name: funcodec_en_libritts_16k_nq32ds320 num_bytes: 925795400 num_examples: 24792 - name: funcodec_en_libritts_16k_nq32ds640 num_bytes: 466669128 num_examples: 24792 - name: funcodec_zh_en_16k_nq32ds320 num_bytes: 925795400 num_examples: 24792 - name: funcodec_zh_en_16k_nq32ds640 num_bytes: 466669128 num_examples: 24792 - name: speech_tokenizer_16k num_bytes: 232351304 num_examples: 24792 download_size: 1435458632 dataset_size: 9259244856 --- # Dataset Card for "noisy_vctk_16k_extract_unit" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:default 数据文件: - 数据拆分:academicodec_hifi_16k_320d,文件路径:data/academicodec_hifi_16k_320d-* - 数据拆分:academicodec_hifi_16k_320d_large_uni,文件路径:data/academicodec_hifi_16k_320d_large_uni-* - 数据拆分:academicodec_hifi_24k_320d,文件路径:data/academicodec_hifi_24k_320d-* - 数据拆分:audiodec_24k_320d,文件路径:data/audiodec_24k_320d-* - 数据拆分:dac_16k,文件路径:data/dac_16k-* - 数据拆分:dac_24k,文件路径:data/dac_24k-* - 数据拆分:dac_44k,文件路径:data/dac_44k-* - 数据拆分:encodec_24k,文件路径:data/encodec_24k-* - 数据拆分:funcodec_en_libritts_16k_gr1nq32ds320,文件路径:data/funcodec_en_libritts_16k_gr1nq32ds320-* - 数据拆分:funcodec_en_libritts_16k_gr8nq32ds320,文件路径:data/funcodec_en_libritts_16k_gr8nq32ds320-* - 数据拆分:funcodec_en_libritts_16k_nq32ds320,文件路径:data/funcodec_en_libritts_16k_nq32ds320-* - 数据拆分:funcodec_en_libritts_16k_nq32ds640,文件路径:data/funcodec_en_libritts_16k_nq32ds640-* - 数据拆分:funcodec_zh_en_16k_nq32ds320,文件路径:data/funcodec_zh_en_16k_nq32ds320-* - 数据拆分:funcodec_zh_en_16k_nq32ds640,文件路径:data/funcodec_zh_en_16k_nq32ds640-* - 数据拆分:speech_tokenizer_16k,文件路径:data/speech_tokenizer_16k-* 数据集信息: 数据特征: - 特征名称:id,数据类型:字符串 - 特征名称:unit,数据结构为双层序列,内层序列元素为64位整数 数据拆分详情: - 数据拆分名称:academicodec_hifi_16k_320d,总字节数:116057288,样本总数:24792 - 数据拆分名称:academicodec_hifi_16k_320d_large_uni,总字节数:116057288,样本总数:24792 - 数据拆分名称:academicodec_hifi_24k_320d,总字节数:173451464,样本总数:24792 - 数据拆分名称:audiodec_24k_320d,总字节数:370177480,样本总数:24792 - 数据拆分名称:dac_16k,总字节数:743941448,样本总数:24792 - 数据拆分名称:dac_24k,总字节数:2140233288,样本总数:24792 - 数据拆分名称:dac_44k,总字节数:641562920,样本总数:24792 - 数据拆分名称:encodec_24k,总字节数:87719016,样本总数:24792 - 数据拆分名称:funcodec_en_libritts_16k_gr1nq32ds320,总字节数:926382152,样本总数:24792 - 数据拆分名称:funcodec_en_libritts_16k_gr8nq32ds320,总字节数:926382152,样本总数:24792 - 数据拆分名称:funcodec_en_libritts_16k_nq32ds320,总字节数:925795400,样本总数:24792 - 数据拆分名称:funcodec_en_libritts_16k_nq32ds640,总字节数:466669128,样本总数:24792 - 数据拆分名称:funcodec_zh_en_16k_nq32ds320,总字节数:925795400,样本总数:24792 - 数据拆分名称:funcodec_zh_en_16k_nq32ds640,总字节数:466669128,样本总数:24792 - 数据拆分名称:speech_tokenizer_16k,总字节数:232351304,样本总数:24792 下载总大小:1435458632 数据集总存储大小:9259244856 --- # 「noisy_vctk_16k_extract_unit」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置信息
- 默认配置:
- 数据文件:
academicodec_hifi_16k_320dacademicodec_hifi_16k_320d_large_uniacademicodec_hifi_24k_320daudiodec_24k_320ddac_16kdac_24kdac_44kencodec_24kfuncodec_en_libritts_16k_gr1nq32ds320funcodec_en_libritts_16k_gr8nq32ds320funcodec_en_libritts_16k_nq32ds320funcodec_en_libritts_16k_nq32ds640funcodec_zh_en_16k_nq32ds320funcodec_zh_en_16k_nq32ds640speech_tokenizer_16k
- 数据文件:
数据集信息
-
特征:
id: 字符串类型unit: 序列类型,包含整数64位
-
分割:
academicodec_hifi_16k_320d:- 字节数: 116057288
- 样本数: 24792
academicodec_hifi_16k_320d_large_uni:- 字节数: 116057288
- 样本数: 24792
academicodec_hifi_24k_320d:- 字节数: 173451464
- 样本数: 24792
audiodec_24k_320d:- 字节数: 370177480
- 样本数: 24792
dac_16k:- 字节数: 743941448
- 样本数: 24792
dac_24k:- 字节数: 2140233288
- 样本数: 24792
dac_44k:- 字节数: 641562920
- 样本数: 24792
encodec_24k:- 字节数: 87719016
- 样本数: 24792
funcodec_en_libritts_16k_gr1nq32ds320:- 字节数: 926382152
- 样本数: 24792
funcodec_en_libritts_16k_gr8nq32ds320:- 字节数: 926382152
- 样本数: 24792
funcodec_en_libritts_16k_nq32ds320:- 字节数: 925795400
- 样本数: 24792
funcodec_en_libritts_16k_nq32ds640:- 字节数: 466669128
- 样本数: 24792
funcodec_zh_en_16k_nq32ds320:- 字节数: 925795400
- 样本数: 24792
funcodec_zh_en_16k_nq32ds640:- 字节数: 466669128
- 样本数: 24792
speech_tokenizer_16k:- 字节数: 232351304
- 样本数: 24792
-
下载大小: 1435458632 字节
-
数据集大小: 9259244856 字节




