ayoub999/LayoutLMv3_dataset_filtred
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: test path: data/test-* dataset_info: features: - name: id dtype: string - name: image dtype: image - name: bboxes sequence: sequence: int64 - name: ner_tags sequence: class_label: names: '0': O '1': Ref '2': NumFa '3': Fourniss '4': DateFa '5': DateLim '6': TotalHT '7': TVA '8': TotalTTc '9': unitP '10': Qt '11': TVAP '12': descp - name: tokens sequence: string splits: - name: train num_bytes: 942956.6666666666 num_examples: 2 - name: test num_bytes: 183522.0 num_examples: 1 download_size: 0 dataset_size: 1126478.6666666665 --- # Dataset Card for "LayoutLMv3_dataset_filtred" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
配置信息
- 配置名称: default
- 数据文件:
- 训练集: data/train-*
- 测试集: data/test-*
- 数据文件:
数据集信息
- 特征:
- id: 字符串类型
- image: 图像类型
- bboxes: 整数序列类型
- ner_tags: 序列类型,包含类别标签
- 标签名称:
- 0: O
- 1: Ref
- 2: NumFa
- 3: Fourniss
- 4: DateFa
- 5: DateLim
- 6: TotalHT
- 7: TVA
- 8: TotalTTc
- 9: unitP
- 10: Qt
- 11: TVAP
- 12: descp
- 标签名称:
- tokens: 字符串序列类型
数据集划分
- 训练集:
- 字节数: 942956.6666666666
- 样本数: 2
- 测试集:
- 字节数: 183522.0
- 样本数: 1
数据集大小
- 下载大小: 0
- 数据集大小: 1126478.6666666665



