遇见数据集

Seynabou/new_dataset_kallama

收藏
Hugging Face2024-07-18 更新2024-07-22 收录
官方服务:

资源简介:

该数据集包含音频和对应的转录文本两个主要特征。数据集被划分为训练集,包含6711个样本,总大小为6367287758.0字节。

The dataset contains two main features: audio and corresponding transcription text. The dataset is divided into a training set, containing 6711 samples, with a total size of 6367287758.0 bytes.

提供机构:
Seynabou
原始信息汇总

数据集概述

许可证

  • MIT许可证

数据集信息

特征

  • 音频
    • 数据类型: 音频
  • 转录文本
    • 数据类型: 字符串

数据分割

  • 训练集
    • 样本数量: 6711
    • 数据大小: 6367287758.0字节

数据集大小

  • 下载大小: 6345114078字节
  • 数据集总大小: 6367287758.0字节

配置

  • 默认配置
    • 数据文件路径: data/train-*
二维码
社区交流群
二维码
科研交流群
商业服务