登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Detection rate in conversational vs audience-oriented files.
Detection rate in conversational vs audience-oriented files.
收藏
Figshare
2021-05-03 更新
2026-04-28 收录
语音识别评估
语境分类检测
数据链接:
https://figshare.com/articles/dataset/Detection_rate_in_conversational_vs_audience-oriented_files_/14530351
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Detection rate in conversational vs audience-oriented files.
应用场景:
创建时间:
2021-05-03
相关数据集
VoxSim
语音相似性
语音识别评估
VoxSim是由韩国科学技术院和三星研究共同创建的大规模感知语音相似度数据集,包含约70,000个相似度评分,来自超过1,000名说话者。数据集内容主要来源于VoxCeleb1,涵盖多种声学环境和多样的说话者特征。创建过程中,通过随机生成语音对并进行听觉测试来收集评分。VoxSim主要应用于自动语音评估领域,旨在解决合成语音的说话者相似度评估问题。
arXiv
2024-07-26 更新
43
0
eval-parakeet-tdt-0.6b-v3-multimed-hard-20260408-1930
语音识别评估
实体识别
该数据集包含 Whisper 模型在特定评估数据集上的评测结果,主要用于语音转文本(speech-to-text)任务的性能评估。数据集包含音频样本(如源数据集提供)、参考转录文本、模型预测文本、词错误率(WER)和字符错误率(CER)等字段。特别地,数据集还包含实体标注信息(如解剖学、生物标志物、条件、药物、组织和程序等类别)及相应的实体字符错误率(Entity CER)。整体实体字符错误率为2
Hugging Face
2026-04-09 更新
11
0
yongchanskii/youtube-data-various-domain
语音识别评估
多语言语音转录
--- dataset_info: features: - name: source dtype: string - name: channelName dtype: string - name: category dtype: string - name: title dtype: string - name: videoId dt
Hugging Face
2024-06-14 更新
6
0
viethq5/asr_evaluation
自动语音识别
语音识别评估
该数据集包含音频和转录文本信息,具体特征包括音频、转录文本、自动语音识别结果(za_asr)、词错误率(WER)、字符错误率(CER)、小写词错误率(lower_WER)、小写字符错误率(lower_CER)、来源(source)和音频ID(audio_id)。数据集分为训练集,包含1002个样本,总大小为110015985.75字节。数据集不支持长音频(测试过20分钟的音频)。
Hugging Face
2024-07-15 更新
17
0
Results of speech recognition and speech and language development outcome.
语音识别评估
语言发展评估
Results of speech recognition and speech and language development outcome.
NIAID Data Ecosystem
6
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广