ylacombe/accent_predictions_v2
收藏官方服务:
资源简介:
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: speaker_id dtype: string - name: most_probable_accent dtype: string - name: entropy_score dtype: float64 - name: accent dtype: string splits: - name: train num_bytes: 9685048869.316 num_examples: 88172 download_size: 9659414610 dataset_size: 9685048869.316 configs: - config_name: default data_files: - split: train path: data/train-* ---
提供机构:
ylacombe原始信息汇总
数据集概述
数据集信息
特征
- audio: 音频数据,采样率为16000。
- speaker_id: 说话者ID,数据类型为字符串。
- most_probable_accent: 最可能的口音,数据类型为字符串。
- entropy_score: 熵分数,数据类型为浮点数(float64)。
- accent: 口音,数据类型为字符串。
数据分割
- train: 训练集,包含88172个样本,总大小为9685048869.316字节。
数据集大小
- 下载大小: 9659414610字节
- 数据集总大小: 9685048869.316字节
配置
- default: 默认配置,包含训练集数据文件路径为
data/train-*。



