JST-SUPERB/Gaussian_unit_part1
收藏资源简介:
--- configs: - config_name: default data_files: - split: academicodec_hifi_16k_320d path: data/academicodec_hifi_16k_320d-* - split: academicodec_hifi_16k_320d_large_uni path: data/academicodec_hifi_16k_320d_large_uni-* - split: academicodec_hifi_24k_320d path: data/academicodec_hifi_24k_320d-* - split: audiodec_24k_320d path: data/audiodec_24k_320d-* - split: dac_16k path: data/dac_16k-* - split: dac_24k path: data/dac_24k-* - split: dac_44k path: data/dac_44k-* - split: speech_tokenizer_16k path: data/speech_tokenizer_16k-* dataset_info: features: - name: speech_input dtype: string - name: noisy_10dB_transcription_whisper-small.en dtype: string - name: noisy_5dB_transcription_whisper-small.en dtype: string - name: noisy_0dB_transcription_whisper-small.en dtype: string - name: noisy_-5dB_transcription_whisper-small.en dtype: string - name: noisy_-10dB_transcription_whisper-small.en dtype: string - name: noisy_10dB_transcription_whisper-medium.en dtype: string - name: noisy_5dB_transcription_whisper-medium.en dtype: string - name: noisy_0dB_transcription_whisper-medium.en dtype: string - name: noisy_-5dB_transcription_whisper-medium.en dtype: string - name: noisy_-10dB_transcription_whisper-medium.en dtype: string - name: noisy_10dB_transcription_whisper-large-v3 dtype: string - name: noisy_5dB_transcription_whisper-large-v3 dtype: string - name: noisy_0dB_transcription_whisper-large-v3 dtype: string - name: noisy_-5dB_transcription_whisper-large-v3 dtype: string - name: noisy_-10dB_transcription_whisper-large-v3 dtype: string - name: output dtype: string - name: clean_audio_transcription_whisper-small.en dtype: string - name: clean_audio_transcription_whisper-medium.en dtype: string - name: clean_audio_transcription_whisper-large-v3 dtype: string - name: clean_audio_unit sequence: sequence: int64 - name: noisy_10dB_unit sequence: sequence: int64 - name: noisy_5dB_unit sequence: sequence: int64 - name: noisy_0dB_unit sequence: sequence: int64 - name: noisy_-5dB_unit sequence: sequence: int64 - name: noisy_-10dB_unit sequence: sequence: int64 splits: - name: academicodec_hifi_16k_320d num_bytes: 253154721 num_examples: 5135 - name: academicodec_hifi_16k_320d_large_uni num_bytes: 253154721 num_examples: 5135 - name: academicodec_hifi_24k_320d num_bytes: 373662945 num_examples: 5135 - name: audiodec_24k_320d num_bytes: 785335617 num_examples: 5135 - name: dac_16k num_bytes: 891596769 num_examples: 5135 - name: dac_24k num_bytes: 3523678209 num_examples: 5135 - name: dac_44k num_bytes: 1147652889 num_examples: 5135 - name: speech_tokenizer_16k num_bytes: 496121793 num_examples: 5135 download_size: 1158957013 dataset_size: 7724357664 --- # Dataset Card for "Gaussian_unit_part1" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:default 数据文件: - 拆分:academicodec_hifi_16k_320d,路径:data/academicodec_hifi_16k_320d-* - 拆分:academicodec_hifi_16k_320d_large_uni,路径:data/academicodec_hifi_16k_320d_large_uni-* - 拆分:academicodec_hifi_24k_320d,路径:data/academicodec_hifi_24k_320d-* - 拆分:audiodec_24k_320d,路径:data/audiodec_24k_320d-* - 拆分:dac_16k,路径:data/dac_16k-* - 拆分:dac_24k,路径:data/dac_24k-* - 拆分:dac_44k,路径:data/dac_44k-* - 拆分:speech_tokenizer_16k,路径:data/speech_tokenizer_16k-* 数据集信息: 特征: - 名称:speech_input,数据类型:字符串 - 名称:noisy_10dB_transcription_whisper-small.en,数据类型:字符串 - 名称:noisy_5dB_transcription_whisper-small.en,数据类型:字符串 - 名称:noisy_0dB_transcription_whisper-small.en,数据类型:字符串 - 名称:noisy_-5dB_transcription_whisper-small.en,数据类型:字符串 - 名称:noisy_-10dB_transcription_whisper-small.en,数据类型:字符串 - 名称:noisy_10dB_transcription_whisper-medium.en,数据类型:字符串 - 名称:noisy_5dB_transcription_whisper-medium.en,数据类型:字符串 - 名称:noisy_0dB_transcription_whisper-medium.en,数据类型:字符串 - 名称:noisy_-5dB_transcription_whisper-medium.en,数据类型:字符串 - 名称:noisy_-10dB_transcription_whisper-medium.en,数据类型:字符串 - 名称:noisy_10dB_transcription_whisper-large-v3,数据类型:字符串 - 名称:noisy_5dB_transcription_whisper-large-v3,数据类型:字符串 - 名称:noisy_0dB_transcription_whisper-large-v3,数据类型:字符串 - 名称:noisy_-5dB_transcription_whisper-large-v3,数据类型:字符串 - 名称:noisy_-10dB_transcription_whisper-large-v3,数据类型:字符串 - 名称:output,数据类型:字符串 - 名称:clean_audio_transcription_whisper-small.en,数据类型:字符串 - 名称:clean_audio_transcription_whisper-medium.en,数据类型:字符串 - 名称:clean_audio_transcription_whisper-large-v3,数据类型:字符串 - 名称:clean_audio_unit,数据类型:嵌套序列,元素为64位整数 - 名称:noisy_10dB_unit,数据类型:嵌套序列,元素为64位整数 - 名称:noisy_5dB_unit,数据类型:嵌套序列,元素为64位整数 - 名称:noisy_0dB_unit,数据类型:嵌套序列,元素为64位整数 - 名称:noisy_-5dB_unit,数据类型:嵌套序列,元素为64位整数 - 名称:noisy_-10dB_unit,数据类型:嵌套序列,元素为64位整数 拆分: - 名称:academicodec_hifi_16k_320d,字节数:253154721,样本数:5135 - 名称:academicodec_hifi_16k_320d_large_uni,字节数:253154721,样本数:5135 - 名称:academicodec_hifi_24k_320d,字节数:373662945,样本数:5135 - 名称:audiodec_24k_320d,字节数:785335617,样本数:5135 - 名称:dac_16k,字节数:891596769,样本数:5135 - 名称:dac_24k,字节数:3523678209,样本数:5135 - 名称:dac_44k,字节数:1147652889,样本数:5135 - 名称:speech_tokenizer_16k,字节数:496121793,样本数:5135 下载大小:1158957013,数据集总大小:7724357664 --- # 「Gaussian_unit_part1」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)



