TuluEng100
收藏资源简介:
TuluEng100 是一个包含 100 个基本 Tulu 句子及其英文翻译的句子对数据集。该数据集是 TuluAI 团队用于构建旗舰模型的大型语料库的一个较小预览版本,旨在供研究者、开发者或爱好者进行实验和探索,以了解仅使用少量句子对(100 对)所能实现的可能性。数据集采用 CC-BY-4.0 许可证,可作为 Tulu 语言与英语之间的翻译、语言学习或基础自然语言处理任务的小规模测试资源。
TuluEng100 is a sentence pair dataset containing 100 basic Tulu sentences with their English translations. This dataset is a smaller preview version of the large corpus used by the TuluAI team to build their flagship model, intended for researchers, developers, or enthusiasts to experiment and explore the possibilities achievable with only a small number of sentence pairs (100 pairs). The dataset is licensed under CC-BY-4.0 and can serve as a small-scale test resource for translation between Tulu and English, language learning, or basic natural language processing tasks.
数据集名称:TuluEng100
许可证:CC-BY-4.0
标签:Tulu、Mangalore、Kudla、Udupi
数据集简介:TuluEng100 是一个包含 100 对基础图鲁语(Tulu)句子及其英语翻译的数据集。该数据集是 TuluAI 用于构建旗舰模型的更大语料库的一个小型预览版本。
用途:该数据集旨在供用户进行实验和探索,尽管其规模不足以训练完整模型,但研究者可以基于这 100 对句子探索可能的用法和效果。




