snskrt/Vyakaran
收藏官方服务:
资源简介:
Vyakaran是一个基于梵文经典文献的NLP数据集,包含43部经典文献中的句子及其对应的形态学分词。适用于训练分词器、预训练变换器、基准测试形态学分析,或探索古代语言艺术。
Vyakaran is an NLP dataset based on Sanskrit classical literature, containing sentences and their corresponding morphological tokens from 43 classics. It is suitable for training segmenters, pre-training transformers, benchmarking morphology analysis, or exploring the art of ancient languages.
提供机构:
snskrt


