Nadav/Hansard
收藏官方服务:
资源简介:
--- dataset_info: features: - name: sentence_id dtype: string - name: text dtype: string - name: decade dtype: string - name: speechdate dtype: string - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 3568239600 num_examples: 8074848 - name: test num_bytes: 398954434 num_examples: 897205 download_size: 1234278574 dataset_size: 3967194034 --- # Dataset Card for "Hansard" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
提供机构:
Nadav原始信息汇总
数据集概述
数据集名称
Hansard
数据集特征
- sentence_id: 数据类型为字符串。
- text: 数据类型为字符串。
- decade: 数据类型为字符串。
- speechdate: 数据类型为字符串。
- index_level_0: 数据类型为整数。
数据集分割
- train: 包含8074848个样本,总大小为3568239600字节。
- test: 包含897205个样本,总大小为398954434字节。
数据集大小
- 下载大小: 1234278574字节。
- 数据集总大小: 3967194034字节。



