Outrun32/BERT-fine-tune-data
收藏资源简介:
--- dataset_info: features: - name: id dtype: int64 - name: text dtype: string - name: label dtype: string - name: extracted_text sequence: string - name: answer_start sequence: int64 - name: answer_end sequence: int64 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 7917987 num_examples: 1799 download_size: 2391476 dataset_size: 7917987 --- # Dataset Card for "BERT-fine-tune-data" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 数据特征项: - 名称:id,数据类型:int64 - 名称:text,数据类型:string - 名称:label,数据类型:string - 名称:extracted_text,数据类型:string序列 - 名称:answer_start,数据类型:int64序列 - 名称:answer_end,数据类型:int64序列 - 名称:__index_level_0__,数据类型:int64 数据集拆分: - 名称:训练集(train),占用字节数:7917987,样本总数:1799 下载大小:2391476 字节,数据集总存储大小:7917987 字节 --- # 「BERT-fine-tune-data」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集特征
- id: 数据类型为
int64 - text: 数据类型为
string - label: 数据类型为
string - extracted_text: 数据类型为
string的序列 - answer_start: 数据类型为
int64的序列 - answer_end: 数据类型为
int64的序列 - index_level_0: 数据类型为
int64
数据集分割
- train: 包含 1799 个样本,占用 7917987 字节
数据集大小
- 下载大小: 2391476 字节
- 数据集大小: 7917987 字节




