nikchar/claim_verification_training_set
收藏资源简介:
--- dataset_info: features: - name: id dtype: int32 - name: label dtype: string - name: claim dtype: string - name: evidence_annotation_id dtype: int32 - name: evidence_id dtype: int32 - name: evidence_wiki_url dtype: string - name: evidence_sentence_id dtype: int32 - name: __index_level_0__ dtype: int64 splits: - name: train num_bytes: 2086271 num_examples: 19998 download_size: 1366415 dataset_size: 2086271 --- # Dataset Card for "20k_claims_train" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- 数据集信息: 特征: - 字段名:id,数据类型:int32 - 字段名:标签(label),数据类型:string - 字段名:断言(claim),数据类型:string - 字段名:证据标注ID(evidence_annotation_id),数据类型:int32 - 字段名:证据ID(evidence_id),数据类型:int32 - 字段名:维基百科证据链接(evidence_wiki_url),数据类型:string - 字段名:证据句子ID(evidence_sentence_id),数据类型:int32 - 字段名:__index_level_0__,数据类型:int64 数据集划分: - 划分名称:train,字节占用量:2086271,样本数量:19998 下载大小:1366415 数据集存储大小:2086271 --- # 「20k_claims_train」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集信息
- 特征列表:
id: 数据类型为int32label: 数据类型为stringclaim: 数据类型为stringevidence_annotation_id: 数据类型为int32evidence_id: 数据类型为int32evidence_wiki_url: 数据类型为stringevidence_sentence_id: 数据类型为int32__index_level_0__: 数据类型为int64
数据集划分
- 训练集:
- 名称:
train - 字节数: 2086271
- 样本数: 19998
- 名称:
数据集大小
- 下载大小: 1366415 字节
- 数据集大小: 2086271 字节



