superxii/donut_test_v3
收藏资源简介:
--- dataset_info: features: - name: id dtype: string - name: image dtype: image - name: query dtype: string - name: answers dtype: string - name: words sequence: string - name: ground_truth dtype: string splits: - name: train num_bytes: 1321125557.0 num_examples: 437 - name: test num_bytes: 1220464415.0 num_examples: 397 download_size: 2538449862 dataset_size: 2541589972.0 --- # Dataset Card for "donut_test_v3" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 特征字段: - 字段名称:id,数据类型:字符串 - 字段名称:image,数据类型:图像(image) - 字段名称:query,数据类型:字符串 - 字段名称:answers,数据类型:字符串 - 字段名称:words,数据类型:字符串序列 - 字段名称:ground_truth(真实标签),数据类型:字符串 数据划分: - 划分名称:训练集(train),占用字节数:1321125557.0,样本数量:437 - 划分名称:测试集(test),占用字节数:1220464415.0,样本数量:397 下载大小:2538449862 数据集总大小:2541589972.0 --- # 「donut_test_v3」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据特征
- id: 字符串类型
- image: 图像类型
- query: 字符串类型
- answers: 字符串类型
- words: 字符串序列
- ground_truth: 字符串类型
数据分割
- train:
- 字节数: 1321125557.0
- 样本数: 437
- test:
- 字节数: 1220464415.0
- 样本数: 397
数据大小
- 下载大小: 2538449862 字节
- 数据集大小: 2541589972.0 字节



