遇见数据集

quickmt/quickmt-train.fa-en

收藏
Hugging Face2026-01-10 更新2025-10-25 收录
官方服务:

资源简介:

这是一个包含波斯语和英语的双语平行语料库,主要用于机器翻译任务。该语料库经过去重和基本过滤,整合了多个来源的数据集,包括但不限于Statmt、Facebook、Neulab、ELRC、LinguaTools、OPUS、Google等机构的公开数据集。

This is a bilingual parallel corpus containing Persian (fa) and English (en) languages, primarily used for machine translation tasks. The corpus has been deduplicated and basic filtered, integrating datasets from multiple sources such as Statmt, Facebook, Neulab, ELRC, LinguaTools, OPUS, Google, and others.

提供机构:
quickmt
二维码
社区交流群
二维码
科研交流群
商业服务