humairmunirawn/sangraha-urdu-only
收藏官方服务:
资源简介:
该数据集包含约544万个样本,每个样本具有文档ID、文本内容和类型三个字段,数据以verified分割形式组织,主要用于文本处理或分类任务。
This dataset contains approximately 5.44 million samples, each with fields for document ID, text content, and type, organized in a verified split, primarily used for text processing or classification tasks.
提供机构:
humairmunirawn


