遇见数据集

michsethowusu/oromo-tumbuka_sentence-pairs

收藏
Hugging Face2025-03-30 更新2025-04-12 收录
官方服务:

资源简介:

该数据集包含非洲语言的句子对及其相似度得分。每个数据行包括三个字段:相似度得分、奥罗莫语句子和对姆布卡语句子。数据集旨在用于训练和评估用于翻译、句子相似度评估和跨语言迁移学习的机器学习模型。

This dataset contains sentence pairs in African languages along with similarity scores. Each row in the dataset includes a similarity score, a sentence in Oromo, and a sentence in Tumbuka. The dataset is intended for use in training and evaluating machine learning models for tasks such as translation, sentence similarity, and cross-lingual transfer learning.

提供机构:
michsethowusu
二维码
社区交流群
二维码
科研交流群
商业服务