lm1b
收藏OpenXLab2026-04-18 收录
官方服务:
资源简介:
A benchmark corpus to be used for measuring progress in statistical language modeling. This has almost one billion words in the training data.
提供机构:
OpenDataLab创建时间:
2023-12-14

A benchmark corpus to be used for measuring progress in statistical language modeling. This has almost one billion words in the training data.