登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
A collection of Akha vocabulary and texts for use in NLP
A collection of Akha vocabulary and texts for use in NLP
收藏
Zenodo
2021-05-17 更新
2026-04-07 收录
低资源自然语言处理
阿卡语语料库
数据链接:
https://zenodo.org/record/4768244
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
This is a collection of Akha (ISO ahk) vocabulary and texts for use in NLP.
应用场景:
提供机构:
Hill, Nathan; Akha, Ghoemeh
创建时间:
2021-05-17
相关数据集
Lots-of-LoRAs/task1351_opus100_translation_gu_en
机器翻译
低资源自然语言处理
task1351_opus100_translation_gu_en是一个文本生成任务的数据集,由众人协作创建。它包含了输入文本、输出文本和唯一标识符。数据集分为训练集、验证集和测试集,分别包含156、19和20个样本。该数据集用于英文到古吉拉特语(Gujarati)的翻译任务。
Hugging Face
2025-01-02 更新
16
0
lowresource_brx_doi_mni
低资源自然语言处理
机器翻译
这是一个低资源语言数据集,包含了源语言(src_lang)和目标语言(tgt_lang)的信息,以及相应的源文本(src)和目标文本(tgt)。数据集目前只有一个训练集split,包含了61251个例子,总大小为26108699字节。
Hugging Face
2025-05-25 更新
7
0
turkana-speech-dataset
低资源自然语言处理
语音合成与识别
Turkana语音数据集是一个专注于Turkana语言(tuv)的语音数据集,Turkana是一种东尼罗特语系的语言,在肯尼亚西北部约有100万使用者。该数据集由Speedykom创建,旨在推动非洲欠发达语言的语音技术发展。数据集包含529个音频片段,总时长约46分钟,平均每个片段5.2秒,音频格式为WAV(16 kHz,单声道),并配有UTF-8编码的文本转录。数据来源于Global Recor
Hugging Face
2026-04-15 更新
2
0
LORELEI Vietnamese Representative Language Pack
低资源自然语言处理
自然语言处理
Introduction LORELEI Vietnamese Representative Language Pack consists of Vietnamese monolingual text, Vietnamese-English parallel text, annotations, supplemental resources and related software tools d
DataCite Commons
2020-08-17 更新
12
0
lecslab/usp-igt-resplit
语言文档学
低资源自然语言处理
--- dataset_info: features: - name: transcription dtype: string - name: segmentation dtype: string - name: pos_glosses dtype: string - name: glosses dtype: string - name: t
Hugging Face
2024-09-18 更新
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广