遇见数据集

hgissbkh/ALMA-Preference-Mono-xCOMET-QE-Choose-Low-Reject-Low

收藏
Hugging Face2024-07-21 更新2024-07-22 收录
官方服务:

资源简介:

该数据集包含多个特征字段,如语言对(lp)、源语言(src_lang)、目标语言(tgt_lang)、源文本(src)、参考文本(ref)、被拒绝的翻译(rejected)、选择的翻译(chosen)、基础翻译(base)等,以及一些评分字段如rejected_xcomet、chosen_xcomet、base_xcomet等。这些字段可能用于机器翻译或文本生成任务中的质量评估。数据集包含一个训练集,大小为16852394字节,包含20575个样本。

The dataset contains multiple feature fields such as language pair (lp), source language (src_lang), target language (tgt_lang), source text (src), reference text (ref), rejected translation (rejected), chosen translation (chosen), base translation (base), and some scoring fields such as rejected_xcomet, chosen_xcomet, base_xcomet, etc. These fields may be used for quality assessment in machine translation or text generation tasks. The dataset includes a training set with a size of 16852394 bytes and contains 20575 samples.

提供机构:
hgissbkh
二维码
社区交流群
二维码
科研交流群
商业服务