遇见数据集

多语种文本翻译平行语料数据集

收藏
国家数据集管理服务平台2026-07-08 更新2026-07-09 收录
官方服务:

资源简介:

本数据集为机器翻译生成的平行语料,数据来源涵盖 Google、Microsoft等国内外主流翻译平台。 数据集包含 157 种语言之间的双向翻译文本对,覆盖多语种、多语言方向,具备较高的翻译质量与一致性。 语料内容涉及多个领域和文体,可用于机器翻译模型训练、跨语言信息处理、多语种对齐研究等任务,为相关研究和应用提供可靠的数据支持。

创建时间:
2026-07-03
搜集汇总
数据集介绍
多语种文本翻译平行语料数据集 数据集图片
背景与挑战
背景概述
该数据集为机器翻译生成的平行语料,源自Google、Microsoft等主流翻译平台,覆盖157种语言的双向翻译文本对,具备高质量与一致性。语料涉及多领域和文体,适用于机器翻译模型训练、跨语言信息处理等任务。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务