遇见数据集

多语种语音识别与智能切换模型数据集合

收藏
上海市数据产品知识产权管理平台2026-09-03 更新2026-09-04 收录
官方服务:

资源简介:

本数据集采用分布式文件系统与关系型数据库混合架构,按日期分区存储,支持大规模并行处理与实时查询,以JSON格式组织多语种语音识别与智能切换所需的训练及推理数据。数据涵盖五类对象: 1、多语种语音语料数据:含音频唯一标识、名称、时长、采样率、位深度、声道数、编码格式、语种标签、方言口音标签、说话人性别年龄段、录音环境、语音内容类型及原始文件路径。 2、语音特征工程数据:含特征样本标识、关联音频ID、帧序号、声学特征、韵律特征、音素后验概率、语种辨识向量、语音活动检测标记及信噪比。 3、语种识别与智能切换训练数据:含样本标识、关联特征ID、起止时间戳、ISO语种编码、置信度分数、切换点标注、上下文语义特征及数据集分割标识。 4、多语种识别模型训练数据含样本标识、关联特征ID、转写文本、词错误率标注、音素序列、声学与语言模型特征向量、端到端输入输出对及模型版本号。 5、语音识别结果与质量评估数据:包含识别记录唯一标识、关联音频ID、识别引擎类型、识别输出文本、识别置信度分数、词错误率、字符错误率、实时率、语种切换决策记录等字段。该数据对象支持语音识别引擎的性能评估与智能切换策略优化。

创建时间:
2026-09-03
搜集汇总
数据集介绍
多语种语音识别与智能切换模型数据集合 数据集图片
背景与挑战
背景概述
该数据集采用分布式文件系统与关系型数据库混合架构,按日期分区存储,以JSON格式组织多语种语音识别与智能切换所需的训练及推理数据,支持大规模并行处理与实时查询。数据涵盖多语种语音语料、语音特征工程、语种识别与智能切换训练、多语种识别模型训练以及语音识别结果与质量评估等五类对象,包含音频属性、声学特征、语种标签、识别文本、置信度及错误率等丰富字段,可支撑语音识别引擎的性能评估与智能切换策略优化。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务