登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Nepali Speech to Text Dataset
Nepali Speech to Text Dataset
收藏
kaggle
2023-05-29 更新
2024-03-11 收录
语音识别
尼泊尔语
数据链接:
https://www.kaggle.com/datasets/ishworsubedii/nepali-speech-to-text-dataset
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Nepali speech recordings and corresponding transcriptions
尼泊尔语语音录音及对应转录文本
应用场景:
创建时间:
2023-05-29
相关数据集
ASR-CCantCSC: A Chinese Cantonese (Canton) Conversational Speech Corpus
语音识别
自然语言处理
This open-source dataset consists of 4.25 hours of transcribed Guangzhou Cantonese conversational speech on certain topics, where ten conversations between ten pairs of speakers were contained.
MagicHub开源社区
2021-03-18 更新
37
0
filipinospeechcorpus
语音识别
语音合成
菲律宾语音语料库(Filipino Speech Corpus, FSC)是一个用于自动语音识别(ASR)和文本转语音(TTS)任务的句子级语音数据集。该数据集以Hugging Face Parquet格式存储,包含16kHz单声道音频片段。数据集总大小约为6GB,由139个分片组成。每个样本包含音频文件、对应的文本转录、音频时长、单词数量、说话者ID、性别、年龄组、语音类型(朗读/自发/机器生成
Hugging Face
2026-03-22 更新
24
0
Nash-pAnDiTa/Moamn-3w7hAYiXdqA
语音识别
音频处理
该数据集包含音频和转录两个特征,音频的采样率为16000Hz,转录的数据类型为字符串。数据集仅包含一个训练分割,共有23个样本,总大小为239938981字节,下载大小为238982817字节。
Hugging Face
2024-12-07 更新
16
0
Speech-Corpus-Collection
语音识别
语音合成
这是一个用于自动语音识别(ASR)和文本到语音(TTS)的语音语料库集合。包含多个数据集,如VCTK、LibriSpeech、TEDLIUM release 2等,用于语音识别和合成研究。
github
2024-02-21 更新
34
0
artyomboyko/common_voice_15_0_RU
语音识别
多语种语音数据
--- dataset_info: features: - name: client_id dtype: string - name: path dtype: audio - name: sentence dtype: string - name: up_votes dtype: int64 - name: down_votes dt
Hugging Face
2023-12-03 更新
18
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广