遇见数据集

prashanthcr/whisper-cr-batch-1

收藏
Hugging Face2026-04-09 更新2026-04-12 收录
官方服务:

资源简介:

--- dataset_info: features: - name: id dtype: string - name: audio dtype: audio: sampling_rate: 24000 - name: emotion_tone dtype: string - name: speaker_id dtype: string - name: user_prompt dtype: string - name: backstory dtype: string - name: consequence dtype: string - name: style dtype: string - name: duration dtype: float64 splits: - name: train num_bytes: 6737946562 num_examples: 10067 - name: train_v2 num_bytes: 3536926707 num_examples: 5048 download_size: 11637130093 dataset_size: 10274873269 configs: - config_name: default data_files: - split: train path: data/train-* - split: train_v2 path: data/train_v2-* ---

数据集信息: 特征字段: - 字段名:id,数据类型:字符串 - 字段名:音频(audio),数据类型:音频格式,采样率为24000赫兹 - 字段名:情绪语调(emotion_tone),数据类型:字符串 - 字段名:说话人ID(speaker_id),数据类型:字符串 - 字段名:用户提示词(user_prompt),数据类型:字符串 - 字段名:背景故事(backstory),数据类型:字符串 - 字段名:后续结果(consequence),数据类型:字符串 - 字段名:风格(style),数据类型:字符串 - 字段名:时长(duration),数据类型:64位双精度浮点数 数据集划分: - 划分名称:train(训练集),占用字节数:6737946562,样本数量:10067 - 划分名称:train_v2(训练集v2),占用字节数:3536926707,样本数量:5048 总下载大小:11637130093 数据集总大小:10274873269 配置项: - 配置名称:default(默认配置),数据文件路径: - 对应train划分:data/train-* - 对应train_v2划分:data/train_v2-*

提供机构:
prashanthcr
二维码
社区交流群
二维码
科研交流群
商业服务