遇见数据集

quickmt/quickmt-train.tr-en

收藏
Hugging Face2025-09-07 更新2025-08-30 收录
官方服务:

资源简介:

这是一个包含土耳其语和英语平行语料库的数据集,来源于多个数据提供者,包括Statmt、Tilde、Neulab、EU、OPUS等。数据集经过去重和基本过滤,适用于机器翻译等NLP任务。

This dataset contains parallel corpora in Turkish and English, sourced from various providers such as Statmt, Tilde, Neulab, EU, OPUS, etc. The corpora have been deduplicated and basic filtered, suitable for NLP tasks like machine translation.

提供机构:
quickmt
二维码
社区交流群
二维码
科研交流群
商业服务