Bykot/c4_ru_200k_removed_fasttext_classifier
收藏官方服务:
资源简介:
该数据集是一个文本数据集,包含两个主要特征:text(文本内容)和reason(原因标注),可能用于自然语言处理任务,如文本分类、原因分析或对话生成。数据集仅包含训练分割,共有156,476个示例,总数据大小约为688MB,下载大小约为328MB。基于特征推断,该数据集可能涉及用户生成文本及其相关原因的解释,适用于训练AI模型进行文本理解和推理任务。
数据集信息: 特征: - 名称:文本(text),数据类型:字符串(string) - 名称:推理依据(reason),数据类型:字符串(string) 数据集划分: - 划分名称:训练集(train),占用字节数:688073329,样本数量:156476 下载大小:327914451 数据集总大小:688073329 配置项: - 配置名称:默认配置(default),数据文件: - 对应划分:训练集(train),文件路径:data/train-*
提供机构:
Bykot


