CrowdMind/finewebedu-100K-samples-256t
收藏官方服务:
资源简介:
该数据集包含文本内容、ID、语言等多种信息,划分为训练集,可用于语言相关的模型训练等任务。
The dataset includes text content, ID, language and other information, divided into training set, which can be used for language-related model training tasks.
提供机构:
CrowdMind


