Mega-COV
收藏官方服务:
资源简介:
Mega-COV 是来自 Twitter 的十亿规模数据集,用于研究 COVID-19。该数据集是多样化的(涵盖 234 个国家)、纵向(可追溯到 2007 年)、多语言(有 65 种语言),并且有大量带有位置标签的推文(约 3200 万条推文)。
Mega-COV is a billion-scale dataset sourced from Twitter for COVID-19 research. It features diverse coverage across 234 countries, a longitudinal temporal span dating back to 2007, multilingual support for 65 languages, and includes a substantial corpus of geotagged tweets, amounting to roughly 32 million in total.
提供机构:
OpenDataLab创建时间:
2022-08-19
搜集汇总
数据集介绍

背景与挑战
背景概述
Mega-COV是一个来自Twitter的十亿规模数据集,专为COVID-19研究设计。它具有多样化(覆盖234个国家)、纵向(可追溯至2007年)、多语言(65种语言)的特点,并包含约3200万条带地理位置标签的推文。
以上内容由遇见数据集搜集并总结生成



