dmrau/cqadupstack-wordpress
收藏资源简介:
--- configs: - config_name: default data_files: - split: queries path: data/queries-* - split: corpus path: data/corpus-* dataset_info: features: - name: _id dtype: string - name: text dtype: string - name: title dtype: string splits: - name: queries num_bytes: 35736 num_examples: 541 - name: corpus num_bytes: 53026140 num_examples: 48605 download_size: 26551471 dataset_size: 53061876 --- # Dataset Card for "cqadupstack-wordpress" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
配置项: - 配置名称:default 数据文件: - 数据划分:queries(查询集),文件路径:data/queries-* - 数据划分:corpus(语料库),文件路径:data/corpus-* 数据集信息: 特征字段: - 字段名:_id,数据类型:字符串 - 字段名:text,数据类型:字符串 - 字段名:title,数据类型:字符串 数据划分详情: - 划分名称:queries(查询集),字节大小:35736,样本数量:541 - 划分名称:corpus(语料库),字节大小:53026140,样本数量:48605 下载大小:26551471,数据集总大小:53061876 # 「cqadupstack-wordpress」数据集卡片 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集概述
数据集配置
- 配置名称: default
- 数据文件:
- 分割: queries
- 路径: data/queries-*
- 分割: corpus
- 路径: data/corpus-*
- 分割: queries
数据集信息
- 特征:
- 名称: _id
- 数据类型: string
- 名称: text
- 数据类型: string
- 名称: title
- 数据类型: string
- 名称: _id
- 分割:
- 名称: queries
- 字节数: 35736
- 样本数: 541
- 名称: corpus
- 字节数: 53026140
- 样本数: 48605
- 名称: queries
- 下载大小: 26551471
- 数据集大小: 53061876



