遇见数据集

COMPRISE_Data10_MENYO-20K_V1.0

收藏
Zenodo2022-02-11 更新2026-05-25 收录
数据链接:
官方服务:

资源简介:

A multi-domain parallel corpus for English-Yoruba language pair that can be used to benchmark machine translation systems. The dataset has 20,100 parallel sentences split into 10,070 train, 3,397 dev, and 6,633 test sentences.

提供机构:
Zenodo
创建时间:
2022-02-08
二维码
社区交流群
二维码
科研交流群
商业服务