遇见数据集

xri/PumaNMT

收藏
Hugging Face2025-02-27 更新2025-02-15 收录
官方服务:

资源简介:

PumaNMT是一个由8000句尼泊尔语和Puma语组成的并行数据集,用于微调神经机器翻译模型和大型语言模型。该数据集采用XRI Global的专有方法创建,适用于低资源语言的模型微调,主要涵盖文学和叙事文本。

PumaNMT is a parallel dataset composed of 8,000 sentences in Nepali and Puma, intended for fine-tuning Neural Machine Translation models and Large Language Models, particularly suitable for literary and narrative texts.

提供机构:
xri
二维码
社区交流群
二维码
科研交流群
商业服务