遇见数据集

TomMoeras/synthetic_data_3M_en-fr_old

收藏
Hugging Face2025-08-28 更新2025-10-25 收录
官方服务:

资源简介:

该数据集是一个包含英文和法语文本对的特征的数据集,用于训练机器翻译或其他自然语言处理任务。训练集包含300万个示例。

This dataset is a collection of English and French text pairs, intended for training machine translation or other natural language processing tasks. The training set contains 3 million examples.

提供机构:
TomMoeras
二维码
社区交流群
二维码
科研交流群
商业服务