遇见数据集

RichNachos/georgian-corpus

收藏
Hugging Face2024-12-22 更新2024-12-14 收录
官方服务:

资源简介:

该数据集名为Georgian Corpus,主要包含格鲁吉亚语(ka)的文本数据。数据集的大小在1百万到1千万之间,适用于需要处理或分析格鲁吉亚语文本的NLP任务。

The dataset, named Georgian Corpus, primarily contains text data in Georgian (ka). The size of the dataset ranges between 1 million and 10 million, making it suitable for NLP tasks that require processing or analyzing Georgian text.

提供机构:
RichNachos
二维码
社区交流群
二维码
科研交流群
商业服务