登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Kazakh CulturaY dataset v1
Kazakh CulturaY dataset v1
收藏
kaggle
2026-06-13 更新
2026-06-17 收录
哈萨克语文本处理
低资源语言语料库
数据链接:
https://www.kaggle.com/datasets/salyamq/kazakh-culturay-dataset-v1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Kazakh-language web text corpus
哈萨克语网页文本语料库
应用场景:
创建时间:
2026-06-13
相关数据集
igbo_monolingual
低资源语言语料库
多语言自然语言处理
Igbo Monolingual Dataset 旨在提供尼日利亚伊博语的单语语料数据,规模包含数千条样本。该数据集内容涵盖多种来源,包括书籍章节、新闻报道等,并针对不同来源的数据设置了不同的字段,例如标题、内容、日期等。此数据集支持文本生成和掩码填充等任务。数据集的具体授权许可信息待补充。
OpenCSG
2024-07-19 更新
10
0
WM1-20180319_02 - Chat while packing sunflower seets
低资源语言语料库
小型零售日常对话
Family member chatting while packing sunflower seeds for their shop, two parts. Language as given: Saek
Research Data Australia
10
0
mbazaNLP/kinyarwanda_monolingual_v01.0
低资源语言语料库
基尼亚卢旺达语NLP
--- task_categories: - text-generation language: - rw size_categories: - 1K !!! PLEASE USE mbazaNLP/kinyarwanda_monolingual_v01.1 !!! # <span style="col
Hugging Face
2024-10-24 更新
9
0
Assamese Corpus
低资源语言语料库
阿萨姆语NLP
Assamese Corpus was developed in the NLP Lab of Gauhati University. Total size of Assamese Corpus (in terms of words) is 1.6 million (1613551 words). The Corpus is prepared...
B2FIND
10
0
RV1-124AV091109 - Stories and conversation Maika, Tony, Hughu
低资源语言语料库
口语话语分析
Asma Maika, Wifred Hughu and Toni Samson Ura are telling stories and making conversation. Language as given: Blanga
Research Data Australia
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广