遇见数据集

WikiText-TL-39

收藏
OpenDataLab2026-07-12 更新2024-05-09 收录
官方服务:

资源简介:

WikiText-TL-39 是菲律宾语的基准语言建模数据集,在训练集中有 3900 万个标记。

WikiText-TL-39 is a benchmark language modeling dataset for the Filipino language, which contains 39 million tokens in its training set.

提供机构:
OpenDataLab
创建时间:
2022-05-24
搜集汇总
数据集介绍
WikiText-TL-39 数据集图片
背景与挑战
背景概述
WikiText-TL-39是一个菲律宾语基准语言建模数据集,其训练集包含3900万个标记,由德拉萨尔大学于2019年发布。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务