anyspeech/fleurs_test
收藏资源简介:
--- configs: - config_name: default data_files: - split: query path: data/query-* - split: candidate path: data/candidate-* dataset_info: features: - name: _id dtype: int64 - name: file_name dtype: string - name: raw_transcription dtype: string - name: transcription dtype: string - name: num_samples dtype: int64 - name: gender dtype: string - name: phones dtype: string - name: audio struct: - name: array sequence: float64 - name: sampling_rate dtype: int64 splits: - name: query num_bytes: 1843536302 num_examples: 1132 - name: candidate num_bytes: 3243527476 num_examples: 1979 download_size: 3137163451 dataset_size: 5087063778 --- # Dataset Card for "fleurs_test" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 配置项: - 配置名称:default 数据文件: - 划分集:query(查询集),路径:data/query-* - 划分集:candidate(候选集),路径:data/candidate-* 数据集信息: 特征字段: - 字段名:_id,数据类型:64位整数(int64) - 字段名:file_name,数据类型:字符串(string) - 字段名:raw_transcription,数据类型:字符串(string) - 字段名:transcription,数据类型:字符串(string) - 字段名:num_samples,数据类型:64位整数(int64) - 字段名:gender,数据类型:字符串(string) - 字段名:phones,数据类型:字符串(string) - 字段名:audio,结构体: - 字段名:array,序列类型:64位浮点数(float64) - 字段名:sampling_rate(采样率),数据类型:64位整数(int64) 划分集详情: - 划分名称:query(查询集),字节占用量:1843536302,样本数:1132 - 划分名称:candidate(候选集),字节占用量:3243527476,样本数:1979 下载总大小:3137163451 数据集总大小:5087063778 --- # 「fleurs_test」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置
- 默认配置:
- 数据文件:
- 查询集:路径为
data/query-* - 候选集:路径为
data/candidate-*
- 查询集:路径为
- 数据文件:
数据特征
- _id:类型为
int64 - file_name:类型为
string - raw_transcription:类型为
string - transcription:类型为
string - num_samples:类型为
int64 - gender:类型为
string - phones:类型为
string - audio:结构包含以下字段:
- array:序列类型为
float64 - sampling_rate:类型为
int64
- array:序列类型为
数据分割
- 查询集:
- 字节数:1843536302
- 样本数:1132
- 候选集:
- 字节数:3243527476
- 样本数:1979
数据大小
- 下载大小:3137163451 字节
- 数据集大小:5087063778 字节



