juancopi81/academia
收藏资源简介:
--- task_categories: - automatic-speech-recognition dataset_info: features: - name: CHANNEL_NAME dtype: string - name: URL dtype: string - name: TITLE dtype: string - name: DESCRIPTION dtype: string - name: TRANSCRIPTION dtype: string - name: SEGMENTS dtype: string splits: - name: train num_bytes: 4010418 num_examples: 52 download_size: 273124 dataset_size: 4010418 tags: - whisper - whispering - medium --- # Dataset Card for "academia" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
任务类别: - 自动语音识别(automatic-speech-recognition) 数据集信息: 特征: - 名称:频道名称(CHANNEL_NAME),数据类型:字符串 - 名称:链接(URL),数据类型:字符串 - 名称:标题(TITLE),数据类型:字符串 - 名称:描述信息(DESCRIPTION),数据类型:字符串 - 名称:转录文本(TRANSCRIPTION),数据类型:字符串 - 名称:分段信息(SEGMENTS),数据类型:字符串 划分集: - 名称:训练集(train),字节大小:4010418,样本数量:52 下载大小:273124 数据集总大小:4010418 标签: - whisper - whispering - medium # 「academia」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
任务类别
- 自动语音识别
数据集信息
特征
- CHANNEL_NAME: 数据类型为字符串
- URL: 数据类型为字符串
- TITLE: 数据类型为字符串
- DESCRIPTION: 数据类型为字符串
- TRANSCRIPTION: 数据类型为字符串
- SEGMENTS: 数据类型为字符串
分割
- train:
- 字节数: 4010418
- 示例数: 52
大小
- 下载大小: 273124字节
- 数据集大小: 4010418字节
标签
- whisper
- whispering
- medium



