遇见数据集

collectivat/ladino-synthetic-parallel

收藏
Hugging Face2025-10-20 更新2025-10-25 收录
官方服务:

资源简介:

这是一个合成的拉迪诺语(犹太-西班牙语)平行语料库,包含了与英语、土耳其语和西班牙语配对的语料。该数据集通过基于规则的西班牙语-拉迪诺语翻译方法生成,旨在支持拉迪诺语这种濒危语言的保护和数字化发展。

This dataset contains synthetic parallel corpora for Ladino paired with English, Turkish, and Spanish. The data was generated using rule-based Spanish-Ladino translation methods to support the preservation and digital development of this endangered language.

提供机构:
collectivat
二维码
社区交流群
二维码
科研交流群
商业服务