选煤厂生产管理运营全场景语音标注数据集
收藏官方服务:
资源简介:
1、数据格式统一处理:对原始语音数据进行格式检测与标准化处理,统一处理为wav格式、采样率16kHz,确保不同来源语音数据具备一致的数据结构,将处理后的路径数据保存在语音文件原始存储路径字段;2、基于音频信号能量特征、短时过零率及频谱特征等参数进行语音活动检测,将语音文件原始存储路径字段下的长音频自动切分为多个有效语音片段,并去除如长时间静音或背景噪声等非语音片段,将新生成的路径存储在语音文件中间存储路径字段;3、按照预设规范化格式将语音文件中间存储路径字段处理成统一格式,保存在语音文件存储路径字段,并将音频文件随之移动;4、采用端到端的非自回归并行建模框架,将语音识别从逐字生成转化为整体序列回归,通过文本长度预测与CTC辅助对齐机制,将声学建模与文本生成两个阶段融合为单阶段推理,实现对语音文件存储路径字段下的音频内容自动转写,生成和语音对应的初始预标注文本数据,得到音频文件对应的初始标注文本字段;5、使用labelme标注软件对数据做进一步标注,得到最终的音频文件对应的文本内容字段。最终形成一组选煤厂生产管理运营全场景语音标注数据集。
提供机构:
中选智控(天津)科技有限公司创建时间:
2026-06-15
搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集面向选煤行业智能化建设,包含1632条经标准化处理的语音数据,覆盖生产调度、设备巡检、工艺操作等场景,采用统一格式、自动转写与人工标注相结合的方式构建,旨在提升工业环境中专业术语和口语化表达的语音识别准确率。
以上内容由遇见数据集搜集并总结生成



