官方服务:
资源简介:
ai hub 경상도 방언 발화 데이터
AI 智能体中心 江原道方言语音数据集
应用场景:
创建时间:
2024-03-25
相关数据集
language-and-voice-lab/malromur_asr
Málrómur语料库是一个开放的、经过手动验证的冰岛语语音语料库。该语料库的录音是在2011年至2012年期间由雷克雅未克大学和冰岛语言技术中心与Google合作收集的。数据集包含来自563名个体的语音样本,总时长为152小时,其中108,568个语音样本被认为是有效的。数据集分为训练、验证和测试三个部分,分别用于自动语音识别任务的模型训练和评估。数据集的主要用途是开发冰岛语的语音识别工具,并可
Hugging Face2023-02-24 更新480
procit006/augmented_stc_saskia_latest_prioritize
这是一个包含音频数据和相应文本描述的数据集,其中包括用户信息和音频的相关属性。数据集分为训练集,可用于音频处理和语言理解等相关任务。
Hugging Face2025-04-07 更新100
seanghay/khmer-speech-large
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: sentence dtype: string splits: - name: train num_bytes: 5686102163.1 num_ex
Hugging Face2023-04-30 更新90
asierhv/composite_corpus_es_v1.0
这是一个西班牙语复合语料库,版本为1.0。语料库包含了音频数据、文本句子和每个句子的持续时间。提供了训练集、多种验证集变体以及多种测试集,用于不同的模型训练和评估。
Hugging Face2024-12-04 更新140
PharynxAI/merged_english_accent_dataset
--- dataset_info: features: - name: audio dtype: audio - name: 'Unnamed: 0' dtype: int64 - name: text dtype: string - name: speaker_id dtype: int64 - name: source dtype
Hugging Face2025-10-09 更新100



