jkorsvik/nowiki_abstract_second_scrape_split1
收藏资源简介:
--- dataset_info: features: - name: url dtype: string - name: date_scraped dtype: string - name: headline dtype: string - name: category dtype: string - name: ingress dtype: string - name: article dtype: string - name: abstract dtype: string - name: id dtype: int64 splits: - name: train num_bytes: 927542194 num_examples: 201819 download_size: 478486503 dataset_size: 927542194 --- # Dataset Card for "nowiki_abstract_second_scrape_split1" [More Information needed](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
--- dataset_info: 特征字段: - 名称:url(统一资源定位符,Uniform Resource Locator),数据类型:字符串 - 名称:date_scraped(爬取日期),数据类型:字符串 - 名称:headline(新闻标题),数据类型:字符串 - 名称:category(分类),数据类型:字符串 - 名称:ingress(导语),数据类型:字符串 - 名称:article(正文),数据类型:字符串 - 名称:abstract(摘要),数据类型:字符串 - 名称:id(编号),数据类型:64位整数 数据集划分: - 名称:train(训练集),占用字节数:927542194,样本数量:201819 下载大小:478486503 数据集总大小:927542194 --- # 数据集卡片:nowiki_abstract_second_scrape_split1 [需补充更多信息](https://github.com/huggingface/datasets/blob/main/CONTRIBUTING.md#how-to-contribute-to-the-dataset-cards)
数据集卡片 "nowiki_abstract_second_scrape_split1"
数据集信息
特征
- url: 字符串类型
- date_scraped: 字符串类型
- headline: 字符串类型
- category: 字符串类型
- ingress: 字符串类型
- article: 字符串类型
- abstract: 字符串类型
- id: 64位整数类型
分割
- train:
- 字节数: 927542194
- 样本数: 201819
大小
- 下载大小: 478486503 字节
- 数据集大小: 927542194 字节



