登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Senju2/Context-Aware-English-to-Arabic-Dataset
Senju2/Context-Aware-English-to-Arabic-Dataset
收藏
Hugging Face
2024-12-04 更新
2024-12-14 收录
机器翻译
自然语言处理
数据链接:
https://hf-mirror.com/datasets/Senju2/Context-Aware-English-to-Arabic-Dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: artistic-2.0 language: - ar - en ---
应用场景:
提供机构:
Senju2
相关数据集
frascuchon/oasst_response_quality
对话系统
自然语言处理
--- size_categories: 1K<n<10K tags: - rlfh - argilla - human-feedback --- # Dataset Card for oasst_response_quality This dataset has been created with [Argilla](https://docs.argilla.io). As shown i
Hugging Face
2023-11-10 更新
10
0
harpreetmann/imdb_with_label_text_truncated
自然语言处理
文本分类
--- dataset_info: features: - name: text dtype: string - name: label dtype: int64 - name: label_text dtype: string - name: count_tokens dtype: int64 splits: - name: train
Hugging Face
2024-06-17 更新
7
0
Pravincoder/llm_train_sample_v2
机器学习
自然语言处理
--- license: bigcode-openrail-m ---
Hugging Face
2023-09-14 更新
7
0
jganzabalseenka/news_2024-07-10_24hs
新闻分析
自然语言处理
该数据集包含多个特征,如资产ID、中文标题、资产目的地、媒体类型、影响程度、开始时间(UTC和本地时间)、实体信息、预测时间、文本内容、关键词、预测延迟等。数据集分为训练集,包含20172个样本,总大小为230689837字节。
Hugging Face
2024-07-12 更新
8
0
Parallel Corpus for Indigenous Language Translation: Spanish-Mazatec and Spanish-Mixtec
机器翻译
土著语言
本研究介绍了首个针对墨西哥两种土著语言Mazatec和Mixtec与西班牙语的平行语料库,旨在支持机器翻译任务。该数据集包含9799句Mazatec语和13235句Mixtec语,主要来源于宗教和宪法领域。数据集的创建过程涉及文本对齐和预处理,以确保数据质量。此数据集的应用领域主要集中在提升低资源语言的机器翻译性能,特别是在从西班牙语翻译到土著语言的方向上显示出较好的效果。
arXiv
2023-05-27 更新
7
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广