Wake Word Spain Spanish Dataset
收藏搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集是一个高质量的西班牙语(西班牙变体)唤醒词数据集,专门用于训练AI和语音模型,包含2000个音频文件,由50名18-50岁的说话者录制,每人录制4个独特关键短语,每个短语10个音频,总计每个说话者40个话语。数据集具有高精度,词错误率(WER)为5%,音频规格为16kHz采样率、单声道、.wav格式,并附带.json转录文件,适用于语音唤醒和命令识别应用。
以上内容由遇见数据集搜集并总结生成



