NatCat
收藏OpenDataLab2026-05-17 更新2024-05-09 收录
下载链接:
https://opendatalab.org.cn/OpenDataLab/NatCat
下载链接
链接失效反馈官方服务:
资源简介:
来自三个在线资源的通用文本分类数据集 (NatCat):Wikipedia、Reddit 和 Stack Exchange。这些数据集由源自社区自然发生的手动管理的文档-类别对组成。
提供机构:
OpenDataLab
创建时间:
2022-06-07
搜集汇总
数据集介绍

背景与挑战
背景概述
NatCat是一个通用文本分类数据集,包含来自Wikipedia、Reddit和Stack Exchange的社区手动管理的文档-类别对。该数据集由芝加哥大学等机构于2021年发布,旨在支持弱监督文本分类任务。
以上内容由遇见数据集搜集并总结生成



