遇见数据集

pnsahoo/newswire-1940-1949

收藏
Hugging Face2024-12-08 更新2024-12-14 收录
官方服务:

资源简介:

该数据集包含多个字段,如文章内容、作者、日期、报纸元数据、各种主题标签(如反垄断、民权、犯罪等)、命名实体识别(NER)相关的词汇和标签、地理位置信息、提到的人物信息等。数据集被分为训练集,包含368,199个样本,总大小为1,851,957,768.15字节。

This dataset includes various fields such as articles, bylines, dates, and newspaper metadata, covering topics like antitrust, civil rights, crime, government regulation, and more. The dataset is divided into a training set with 368,199 samples.

提供机构:
pnsahoo
二维码
社区交流群
二维码
科研交流群
商业服务