LangAGI-Lab/DONUT
收藏资源简介:
--- configs: - config_name: default data_files: - split: train path: data/train-* dataset_info: features: - name: context_id dtype: int64 - name: candidate_id dtype: int64 - name: context sequence: string - name: target dtype: string - name: label dtype: string splits: - name: train num_bytes: 319463974 num_examples: 367337 download_size: 51456522 dataset_size: 319463974 --- # Dataset Card for "DONUT" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称:default 数据文件: - 拆分集:train(训练集) 路径:data/train-* 数据集信息: 特征字段: - 字段名:context_id,数据类型:int64 - 字段名:candidate_id,数据类型:int64 - 字段名:context,数据类型:字符串序列 - 字段名:target,数据类型:string - 字段名:label,数据类型:string 数据集拆分: - 拆分集名称:train(训练集),总字节数:319463974,样本数量:367337 下载总大小:51456522 数据集总大小:319463974 # “DONUT”数据集卡片 [更多信息待补充](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)



