humair025/urdu_wikipedia
收藏官方服务:
资源简介:
这是一个包含id、url、title和text字段的数据集,适用于文本处理相关的任务。数据集分为训练集,共有200154个文本样本,数据集大小为410511855字节。
This dataset includes fields for id, url, title, and text, suitable for text processing tasks. It is split into a training set with a total of 200154 text samples, with a dataset size of 410511855 bytes.
提供机构:
humair025


