登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
智能喊话设备多语种语音指令识别数据集
智能喊话设备多语种语音指令识别数据集
收藏
安徽省数据知识产权登记平台
2025-11-24 更新
2025-12-17 收录
语音识别
多语种处理
数据链接:
http://58.56.66.75:14401/#/registerAnnouncementDetail?id=86235020-b2d3-4fe4-9475-edb83bbd78cc&state=2
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
由安徽星弘烨智能科技有限公司自建系统采集的原始语音数据加工而来。
应用场景:
提供机构:
安徽星弘烨智能科技有限公司
创建时间:
2025-11-21
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集是一个专为智能喊话设备设计的语音指令识别训练语料,规模达70000小时,包含多语种语音数据及其转写文本、翻译和说话人属性(如年龄、性别、地区)。它旨在支持军事、警用等复杂环境下的高精度离线语音识别和实时翻译,通过多样化语料提升模型在噪声环境中的适应性和跨语言沟通能力。
以上内容由遇见数据集搜集并总结生成
相关数据集
Alwaly/french_librispeech
语音识别
音频处理
该数据集包含音频和文本数据,特征包括文件路径、音频数据(采样率为16000Hz)、文本内容、说话者ID、章节ID和唯一ID。数据集仅包含训练集,大小为4194379926.256字节,包含17214个样本。
Hugging Face
2024-06-22 更新
9
0
averageandyyy/combined_librispeech_self
语音识别
机器学习
--- dataset_info: features: - name: audio dtype: audio - name: transcript dtype: string splits: - name: train num_bytes: 6992473149.621 num_examples: 28539 - name: test
Hugging Face
2023-05-25 更新
9
0
ae-mask-distilled-libri-one-sec-cv12/chunk_12
音频处理
语音识别
该数据集包含音频数据和对应的浮点数序列。音频数据的采样率为16000Hz,浮点数序列用于表示音频的logits。数据集包含一个训练集,共有1041个样本,总大小为33373549.193571053字节。数据集的下载大小为29565582字节。数据集的配置文件指定了默认配置,数据文件路径为data/train-*。
Hugging Face
2024-07-01 更新
8
0
Yettiesoft/voice_medical_cut_medium_vector
语音识别
医疗数据分析
--- dataset_info: features: - name: input_features sequence: sequence: float32 - name: labels sequence: int64 splits: - name: train num_bytes: 32750599200 num_examples:
Hugging Face
2024-06-13 更新
9
0
raidavid/backupchanghua11
语音识别
自然语言处理
该数据集包含音频和对应的文本句子,音频的采样率为16000Hz。数据集仅包含一个训练集,共有2852个样本,总大小为281675372.5字节。数据文件位于data/train-*路径下。
Hugging Face
2024-06-15 更新
8
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广