Codec-SUPERB/vox_lingua_top10_synth
收藏资源简介:
--- configs: - config_name: default data_files: - split: original path: data/original-* - split: academicodec_hifi_16k_320d path: data/academicodec_hifi_16k_320d-* - split: academicodec_hifi_16k_320d_large_uni path: data/academicodec_hifi_16k_320d_large_uni-* - split: academicodec_hifi_24k_320d path: data/academicodec_hifi_24k_320d-* - split: audiodec_24k_320d path: data/audiodec_24k_320d-* - split: dac_16k path: data/dac_16k-* - split: dac_24k path: data/dac_24k-* - split: dac_44k path: data/dac_44k-* - split: encodec_24k_12bps path: data/encodec_24k_12bps-* - split: encodec_24k_1_5bps path: data/encodec_24k_1_5bps-* - split: encodec_24k_24bps path: data/encodec_24k_24bps-* - split: encodec_24k_3bps path: data/encodec_24k_3bps-* - split: encodec_24k_6bps path: data/encodec_24k_6bps-* - split: funcodec_en_libritts_16k_gr1nq32ds320 path: data/funcodec_en_libritts_16k_gr1nq32ds320-* - split: funcodec_en_libritts_16k_gr8nq32ds320 path: data/funcodec_en_libritts_16k_gr8nq32ds320-* - split: funcodec_en_libritts_16k_nq32ds320 path: data/funcodec_en_libritts_16k_nq32ds320-* - split: funcodec_en_libritts_16k_nq32ds640 path: data/funcodec_en_libritts_16k_nq32ds640-* - split: funcodec_zh_en_16k_nq32ds320 path: data/funcodec_zh_en_16k_nq32ds320-* - split: funcodec_zh_en_16k_nq32ds640 path: data/funcodec_zh_en_16k_nq32ds640-* - split: speech_tokenizer_16k path: data/speech_tokenizer_16k-* dataset_info: features: - name: audio dtype: audio: sampling_rate: 48000 - name: id dtype: string splits: - name: original num_bytes: 1739423546.0 num_examples: 972 - name: academicodec_hifi_16k_320d num_bytes: 579867274.0 num_examples: 972 - name: academicodec_hifi_16k_320d_large_uni num_bytes: 579867274.0 num_examples: 972 - name: academicodec_hifi_24k_320d num_bytes: 869756554.0 num_examples: 972 - name: audiodec_24k_320d num_bytes: 870223236.0 num_examples: 972 - name: dac_16k num_bytes: 579867274.0 num_examples: 972 - name: dac_24k num_bytes: 869756554.0 num_examples: 972 - name: dac_44k num_bytes: 1598103370.0 num_examples: 972 - name: encodec_24k_12bps num_bytes: 869756554.0 num_examples: 972 - name: encodec_24k_1_5bps num_bytes: 869756554.0 num_examples: 972 - name: encodec_24k_24bps num_bytes: 869756554.0 num_examples: 972 - name: encodec_24k_3bps num_bytes: 869756554.0 num_examples: 972 - name: encodec_24k_6bps num_bytes: 869756554.0 num_examples: 972 - name: funcodec_en_libritts_16k_gr1nq32ds320 num_bytes: 579867274.0 num_examples: 972 - name: funcodec_en_libritts_16k_gr8nq32ds320 num_bytes: 579867274.0 num_examples: 972 - name: funcodec_en_libritts_16k_nq32ds320 num_bytes: 579867274.0 num_examples: 972 - name: funcodec_en_libritts_16k_nq32ds640 num_bytes: 579867274.0 num_examples: 972 - name: funcodec_zh_en_16k_nq32ds320 num_bytes: 579867274.0 num_examples: 972 - name: funcodec_zh_en_16k_nq32ds640 num_bytes: 579867274.0 num_examples: 972 - name: speech_tokenizer_16k num_bytes: 579867274.0 num_examples: 972 download_size: 10114887749 dataset_size: 16094718770.0 --- # Dataset Card for "vox_lingua_top10_synth" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 默认配置:
- 数据文件:
original:路径为data/original-*academicodec_hifi_16k_320d:路径为data/academicodec_hifi_16k_320d-*academicodec_hifi_16k_320d_large_uni:路径为data/academicodec_hifi_16k_320d_large_uni-*academicodec_hifi_24k_320d:路径为data/academicodec_hifi_24k_320d-*audiodec_24k_320d:路径为data/audiodec_24k_320d-*dac_16k:路径为data/dac_16k-*dac_24k:路径为data/dac_24k-*dac_44k:路径为data/dac_44k-*encodec_24k_12bps:路径为data/encodec_24k_12bps-*encodec_24k_1_5bps:路径为data/encodec_24k_1_5bps-*encodec_24k_24bps:路径为data/encodec_24k_24bps-*encodec_24k_3bps:路径为data/encodec_24k_3bps-*encodec_24k_6bps:路径为data/encodec_24k_6bps-*funcodec_en_libritts_16k_gr1nq32ds320:路径为data/funcodec_en_libritts_16k_gr1nq32ds320-*funcodec_en_libritts_16k_gr8nq32ds320:路径为data/funcodec_en_libritts_16k_gr8nq32ds320-*funcodec_en_libritts_16k_nq32ds320:路径为data/funcodec_en_libritts_16k_nq32ds320-*funcodec_en_libritts_16k_nq32ds640:路径为data/funcodec_en_libritts_16k_nq32ds640-*funcodec_zh_en_16k_nq32ds320:路径为data/funcodec_zh_en_16k_nq32ds320-*funcodec_zh_en_16k_nq32ds640:路径为data/funcodec_zh_en_16k_nq32ds640-*speech_tokenizer_16k:路径为data/speech_tokenizer_16k-*
- 数据文件:
数据集信息
-
特征:
audio:采样率为 48000 Hzid:字符串类型
-
分割:
original:字节数为 1739423546.0,样本数为 972academicodec_hifi_16k_320d:字节数为 579867274.0,样本数为 972academicodec_hifi_16k_320d_large_uni:字节数为 579867274.0,样本数为 972academicodec_hifi_24k_320d:字节数为 869756554.0,样本数为 972audiodec_24k_320d:字节数为 870223236.0,样本数为 972dac_16k:字节数为 579867274.0,样本数为 972dac_24k:字节数为 869756554.0,样本数为 972dac_44k:字节数为 1598103370.0,样本数为 972encodec_24k_12bps:字节数为 869756554.0,样本数为 972encodec_24k_1_5bps:字节数为 869756554.0,样本数为 972encodec_24k_24bps:字节数为 869756554.0,样本数为 972encodec_24k_3bps:字节数为 869756554.0,样本数为 972encodec_24k_6bps:字节数为 869756554.0,样本数为 972funcodec_en_libritts_16k_gr1nq32ds320:字节数为 579867274.0,样本数为 972funcodec_en_libritts_16k_gr8nq32ds320:字节数为 579867274.0,样本数为 972funcodec_en_libritts_16k_nq32ds320:字节数为 579867274.0,样本数为 972funcodec_en_libritts_16k_nq32ds640:字节数为 579867274.0,样本数为 972funcodec_zh_en_16k_nq32ds320:字节数为 579867274.0,样本数为 972funcodec_zh_en_16k_nq32ds640:字节数为 579867274.0,样本数为 972speech_tokenizer_16k:字节数为 579867274.0,样本数为 972
-
数据集大小:
- 下载大小:10114887749 字节
- 数据集大小:16094718770.0 字节



