rumik-ai/whisper-batch-ira
收藏资源简介:
--- dataset_info: features: - name: id dtype: string - name: audio dtype: audio: sampling_rate: 24000 - name: emotion_tone dtype: string - name: speaker_id dtype: string - name: user_prompt dtype: string - name: backstory dtype: string - name: consequence dtype: string - name: style dtype: string - name: duration dtype: float64 splits: - name: train num_bytes: 6737946562 num_examples: 10067 - name: train_v2 num_bytes: 3536926707 num_examples: 5048 download_size: 11637130093 dataset_size: 10274873269 configs: - config_name: default data_files: - split: train path: data/train-* - split: train_v2 path: data/train_v2-* ---
数据集详情: 特征字段: - 字段名:id 数据类型:字符串 - 字段名:audio 数据类型: 音频数据类型: 采样率:24000 Hz - 字段名:emotion_tone 数据类型:字符串 - 字段名:speaker_id 数据类型:字符串 - 字段名:user_prompt 数据类型:字符串 - 字段名:backstory 数据类型:字符串 - 字段名:consequence 数据类型:字符串 - 字段名:style 数据类型:字符串 - 字段名:duration 数据类型:float64(64位浮点数) 数据集划分: - 划分名称:train(训练集) 占用字节数:6737946562 样本数量:10067 - 划分名称:train_v2(第二代训练集) 占用字节数:3536926707 样本数量:5048 下载总体积:11637130093 数据集总存储体积:10274873269 配置项: - 配置名称:default(默认配置) 数据文件: - 对应划分:train 文件路径:data/train-* - 对应划分:train_v2 文件路径:data/train_v2-*



