人工智能中文-乌尔都文平行语料数据集
收藏数据链接:
官方服务:
资源简介:
本数据集面向中文与乌尔都文平行语料的采集与标注场景,适用于跨语言机器翻译、双语对齐与跨语言理解技术的研发与应用。该数据可用于中文与乌尔都文双向神经机器翻译模型的训练、评测及优化,提升翻译系统对中文与乌尔都文自然文本的翻译效果与鲁棒性;可用于跨语言信息检索、双语词典构建与语言学研究,支撑面向多语种智能翻译、跨境交流等产品的算法验证与效果调优。数据集由成对的中文文本与对应的乌尔都文译文组成,配套编号标识与双语对齐标注,可为相关人工智能模型提供规范的中乌尔都文平行训练与评测语料。
提供机构:
数据堂(北京)科技股份有限公司搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集由成对的中文文本与乌尔都文译文组成,并配有编号标识和双语对齐标注,主要用于跨语言机器翻译、双语对齐及跨语言理解等人工智能技术的研发与应用。它可支撑中文与乌尔都文双向神经机器翻译模型的训练、评测和优化,也可服务于跨语言信息检索、双语词典构建及语言学研究等场景。
以上内容由遇见数据集搜集并总结生成



