遇见数据集

Noobbbbb/bengaliai-asr-dataset-125k

收藏
Hugging Face2026-05-22 更新2026-05-31 收录
官方服务:

资源简介:

该数据集是一个音频-文本配对数据集,主要用于语音识别或音频处理任务。它包含124,998个训练示例和29,588个验证示例,每个示例包括音频数据(采样率为16000Hz)、对应的文本转录和唯一标识符(ID)。音频数据以原始音频格式存储,文本为字符串类型。数据集总大小约为23.16GB,下载大小约为23.15GB,适用于训练和验证机器学习模型,特别是针对语音到文本的转换应用。

This is an audio-text paired dataset primarily designed for speech recognition or audio processing tasks. It contains 124,998 training samples and 29,588 validation samples. Each sample comprises audio data with a sampling rate of 16000 Hz, the corresponding text transcription, and a unique identifier (ID). The audio data is stored in raw audio format, while the text is of string data type. The total size of the dataset is approximately 23.16 GB, and its download size is around 23.15 GB. This dataset is suitable for training and validating machine learning models, especially for speech-to-text conversion applications.

提供机构:
Noobbbbb
二维码
社区交流群
二维码
科研交流群
商业服务