遇见数据集

东盟多语种语料翻译数据集

收藏
国家数据集管理服务平台2026-07-10 更新2026-07-11 收录
官方服务:

资源简介:

该数据集是一个包含泰语、越南语、高棉语、马来语、缅甸语、印尼语中到外的高质量翻译数据集,广泛应用于翻译识别等研究领域。这些数据能够为多语种学习者提供多样化场景和识别引擎的训练提供帮助。

创建时间:
2026-07-08
搜集汇总
数据集介绍
东盟多语种语料翻译数据集 数据集图片
背景与挑战
背景概述
该数据集是一个高质量的多语种翻译语料库,涵盖泰语、越南语、高棉语、马来语、缅甸语和印尼语的中到外翻译内容,规模为0.09GB、包含20万句对。它主要用于翻译识别研究和多语种学习,支持识别引擎训练,数据格式为XLSX,涉及政治、经济和科技等领域。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务