TomMoeras/synthetic_data_3M_en-fr_old
收藏官方服务:
资源简介:
该数据集是一个包含英文和法语文本对的特征的数据集,用于训练机器翻译或其他自然语言处理任务。训练集包含300万个示例。
This dataset is a collection of English and French text pairs, intended for training machine translation or other natural language processing tasks. The training set contains 3 million examples.
提供机构:
TomMoeras


