人工智能英文-土耳其文平行语料文本数据集
收藏数据链接:
官方服务:
资源简介:
本数据集面向英文与土耳其文平行语料的采集与标注场景,适用于跨语言机器翻译、双语对齐与跨语言理解技术的研发与应用。该数据可用于英土双向神经机器翻译模型的训练、评测及优化,提升翻译系统对土耳其文这一土耳其语系主要语言的翻译质量与鲁棒性;可用于跨语言信息检索、双语词典构建与语言学研究,支撑面向英土跨境交流、多语种智能翻译等产品的算法验证与效果调优。数据集由成对的英文文本与对应的土耳其文译文组成,配套编号标识与双语对齐标注,可为相关人工智能模型提供高质量的英土平行训练与评测语料。
提供机构:
数据堂(北京)科技股份有限公司搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集是面向英文与土耳其文平行语料采集与标注的文本数据集,适用于跨语言机器翻译、双语对齐及跨语言理解等技术的研发与应用。数据集由成对的英文文本与对应土耳其文译文构成,配有编号标识与双语对齐标注,可为英土双向神经机器翻译模型的训练、评测和优化,以及跨语言信息检索、双语词典构建和语言学分析等提供高质量语料支撑。
以上内容由遇见数据集搜集并总结生成



