登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
English to Bengali dataset
English to Bengali dataset
收藏
kaggle
2024-02-02 更新
2024-03-07 收录
机器翻译
跨语言处理
数据链接:
https://www.kaggle.com/datasets/jigarpanjiyar/english-to-bengali-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
English to Bengali parallel dataset
应用场景:
创建时间:
2024-02-02
相关数据集
homersimpson/opensubtitles_fr
机器翻译
语言数据
该数据集包含电影相关的元数据和翻译信息,具体包括电影的ID、年份、IMDb ID、字幕ID及其对应的语言(加泰罗尼亚语和法语)。数据集分为训练集、验证集和测试集,分别包含240000、30000和30000个示例。数据集的总下载大小为26004408字节,总大小为36369003字节。
Hugging Face
2023-12-05 更新
16
0
zenless-lab/alt
机器翻译
多语言文本
该数据集是一个包含英语和日语文本对的多语言数据集,适用于训练机器翻译模型。数据集包含多个配置版本,每个版本都有唯一的标识符、英语文本和日语文本,并且分为训练集和测试集。
Hugging Face
2024-12-20 更新
15
0
michsethowusu/kinyarwanda-tsonga_sentence-pairs
自然语言处理
机器翻译
该数据集包含非洲语言句子对及其相似度评分,适用于机器翻译、句子对齐或其他自然语言处理任务。数据集基于NLLBv1构建,包含332,229行,每行有三个字段:相似度评分、基尼亚鲁旺达语句子和宗加语句子。可用于训练和评估机器学习模型,进行翻译、句子相似度计算和跨语言迁移学习等任务。
Hugging Face
2025-03-30 更新
13
0
GALE Phase 4 Arabic Weblog Parallel Sentences
机器翻译
平行语料库
Introduction GALE Phase 4 Arabic Weblog Parallel Sentences was developed by the Linguistic Data Consortium (LDC). Along with other corpora, the parallel text in this release comprised
DataCite Commons
2021-07-01 更新
16
0
Kosp2e
机器翻译
语言学
Kosp2e(读作“kospi”)是一个语料库,可以将韩语语音以端到端的方式翻译成英文文本
OpenDataLab
2026-07-12 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广