遇见数据集

quickmt/quickmt-train.ko-en

收藏
Hugging Face2025-09-07 更新2025-04-12 收录
官方服务:

资源简介:

这是一个韩文-英文的双语训练语料库,包含了来自多个子集的数据,这些子集经过去重和基本过滤处理。子集包括OPUS系列、维基百科、TED演讲、开源字幕等多种类型的数据。

This is a Korean-English bilingual training corpus containing data from multiple subsets, which have been deduplicated and basic filtered. These subsets include OPUS series, Wikipedia, TED talks, open subtitles, and various other types of data.

提供机构:
quickmt
二维码
社区交流群
二维码
科研交流群
商业服务