登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
D338_ChineseHebrew_Parallel_Corpus_Data
D338_ChineseHebrew_Parallel_Corpus_Data
收藏
Opencsg
2026-03-04 更新
2026-03-14 收录
机器翻译
平行语料库
数据链接:
https://www.opencsg.com/datasets/DatatangBeijing/D338_ChineseHebrew_Parallel_Corpus_Data
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
114万组中希伯来平行互译语料,数据存储格式为txt文档,覆盖旅游,日常,新闻等多个领域.已进行数据清洗脱敏质检,可作为文本类数据分析的基础语料库,用于机器翻译等领域.
应用场景:
创建时间:
2026-03-04
相关数据集
News-Commentary Dataset
机器翻译
自然语言处理
该数据集包含了用于低资源环境下的英德和英俄平行句子,旨在用于神经机器翻译的训练。具体来说,该数据集包含了约440,000句英译德句子和380,000句英译俄句子。
arXiv
33
0
BBAW Dataset
自然语言处理
机器翻译
该数据集包含了100,736个样本的平行数据,这些数据被翻译成了德语。需要注意的是,该数据集不包括象形图像特征。规模上,数据集共有100,736个样本,任务是对这些样本进行翻译。
arXiv
11
0
odunola/french-english-preprocessed
机器翻译
跨语言处理
--- dataset_info: features: - name: english_transcript dtype: string - name: input_features sequence: sequence: float32 - name: labels sequence: int64 splits: - name: tra
Hugging Face
2024-01-06 更新
6
0
Parikshith/grow-1-monolingual-ha-en-comet-wmt21
机器翻译
翻译质量评估
--- dataset_info: features: - name: src dtype: string - name: mt dtype: string - name: score dtype: float64 splits: - name: small num_bytes: 24923873 num_examples: 1000
Hugging Face
2023-12-02 更新
17
0
fia24/filtered_annotated_100k
机器翻译
自然语言处理
该数据集包含英语和法语的翻译对,每个翻译对都有一个唯一的id。数据集分为训练集、验证集和测试集,分别包含80327、10041和10041个示例。训练集、验证集和测试集的总字节数分别为4712463、579956和589599。整个数据集的下载大小为3103329字节,数据集大小为5882018字节。
Hugging Face
2024-01-27 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广