遇见数据集

Tamil Combined Pretraining Dataset

收藏
kaggle2026-09-05 更新2026-09-11 收录
官方服务:

资源简介:

A Cumulated Tamil and Tanglish corpus for causal language-model pretrain

创建时间:
2026-08-14
二维码
社区交流群
二维码
科研交流群
商业服务