garutyunov/litbank-entities
收藏资源简介:
--- dataset_info: features: - name: id dtype: string - name: text dtype: string - name: tokens sequence: string - name: ner_tags sequence: string - name: ner_spans sequence: sequence: int32 splits: - name: train num_bytes: 6575841 num_examples: 100 download_size: 2042117 dataset_size: 6575841 --- # Dataset Card for "litbank-entities" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 特征字段: - 字段名:id,数据类型:字符串(string) - 字段名:text,数据类型:字符串(string) - 字段名:tokens,数据类型:字符串序列(sequence) - 字段名:ner_tags,数据类型:字符串序列(sequence),即命名实体识别标签(ner_tags) - 字段名:ner_spans,数据类型:序列的序列(sequence),内层序列元素为32位整数(int32),即命名实体跨度(ner_spans) 数据集划分: - 划分名称:train(训练集),字节占用量:6575841,样本数量:100 下载大小:2042117 数据集总字节大小:6575841 --- # "litbank-entities"数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集名称
- 名称: litbank-entities
数据集特征
- 特征列表:
- id: 数据类型为字符串。
- text: 数据类型为字符串。
- tokens: 数据类型为字符串序列。
- ner_tags: 数据类型为字符串序列。
- ner_spans: 数据类型为整数序列的序列。
数据集分割
- 分割详情:
- train:
- 样本数量: 100
- 数据大小: 6575841字节
- train:
数据集大小
- 下载大小: 2042117字节
- 数据集总大小: 6575841字节



