遇见数据集

pauhidalgoo/ca-CulturaX-tagged

收藏
Hugging Face2024-08-22 更新2024-12-14 收录
官方服务:

资源简介:

该数据集包含文本、时间戳、URL、来源和教育评分等特征,主要用于训练模型。数据集分为一个训练集,包含15,531,777个样本,总大小为50,497,190,152字节。

This dataset includes features such as text, timestamp, URL, source, and education score, primarily used for training models. The dataset is divided into one training set containing 15,531,777 samples, with a total size of 50,497,190,152 bytes.

提供机构:
pauhidalgoo
二维码
社区交流群
二维码
科研交流群
商业服务