BELLE-1.5M
收藏官方服务:
资源简介:
1.5M中文数据集由跨越多个 (指令) 类型和多个字段的子集组成。
The 1.5M Chinese dataset comprises subsets spanning multiple (instruction) types and multiple fields.
创建时间:
2024-04-23
搜集汇总
数据集介绍

背景与挑战
背景概述
BELLE-1.5M是一个包含150万条数据的中文数据集,由跨越多个指令类型和字段的子集组成,主要用于文本分类任务。该数据集规模较大,覆盖多样化的中文指令场景,适合用于训练和评估文本分类模型。
以上内容由遇见数据集搜集并总结生成



