登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
中-维吾尔语平行语料
中-维吾尔语平行语料
收藏
合肥数据要素流通平台
2023-12-19 更新
2024-03-01 收录
机器翻译
语言资源
数据链接:
https://www.bigdatadex.com.cn/dataCirculation/listMoreb/details?shopId=1736934350824534018&commodityType=2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
中-维吾尔语平行语料
Chinese-Uyghur Parallel Corpus
应用场景:
提供机构:
合肥群音信息服务有限公司
创建时间:
2023-12-19
搜集汇总
数据集介绍
背景与挑战
背景概述
中-维吾尔语平行语料是一个涉及口语、通用、科技、政治、旅游等多个领域的数据集,准确率95%以上,量级达1000万句以上。该数据集由合肥群音信息服务有限公司提供,适用于人工智能领域的研究和应用。
以上内容由遇见数据集搜集并总结生成
相关数据集
argilla/prompt-translation-for-es-bench
机器翻译
模型评估
--- dataset_info: features: - name: input dtype: string - name: generation_model sequence: string - name: generation_prompt list: list: - name: content dtype: s
Hugging Face
2024-03-21 更新
18
0
99eren99/Tr-NanoBEIR
自然语言处理
机器翻译
NanoBEIR数据集的土耳其语翻译版本,利用Opus MT模型进行翻译。
Hugging Face
2025-04-07 更新
13
0
ignacioct/flores200_es_en_dev_test
机器翻译
语言对齐
--- dataset_info: features: - name: id dtype: int64 - name: es_sentence dtype: string - name: en_sentence dtype: string - name: domain dtype: string - name: topic dtype
Hugging Face
2024-05-06 更新
6
0
hgissbkh/wmt22-23-test-metrics
机器翻译
翻译评估
该数据集包含多种语言对的翻译数据,涵盖了源语言、目标语言、源文本、参考文本以及多个不同模型和配置下的输出和评分。数据集还包含了多个评估指标(如chrf、bleu、xcomet、kiwi)的评分。数据集分为训练集,包含38098个样本,总大小为130593023字节。
Hugging Face
2024-07-05 更新
14
0
WMT corpora
机器翻译
自然语言处理
该数据集包括两个从非领域语料库中提取的选定领域内数据集,分别包含约90万和110万条从原始310万条句子中筛选出的句子。数据的筛选基于与领域内数据集的相似性,这有助于提升翻译性能。规模上,这两个数据集分别约为90万和110万条句子,用于对神经机器翻译模型进行微调任务。
arXiv
12
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广