WikiText-TL-39
收藏官方服务:
资源简介:
WikiText-TL-39 是菲律宾语的基准语言建模数据集,在训练集中有 3900 万个标记。
WikiText-TL-39 is a benchmark language modeling dataset for the Filipino language, which contains 39 million tokens in its training set.
提供机构:
OpenDataLab创建时间:
2022-05-24
搜集汇总
数据集介绍

背景与挑战
背景概述
WikiText-TL-39是一个菲律宾语基准语言建模数据集,其训练集包含3900万个标记,由德拉萨尔大学于2019年发布。
以上内容由遇见数据集搜集并总结生成



