登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Transcription accuracy on clean audio using Google Speech-to-Text.
Transcription accuracy on clean audio using Google Speech-to-Text.
收藏
Figshare
2026-01-12 更新
2026-04-28 收录
语音识别评测
语音转文本准确率
数据链接:
https://figshare.com/articles/dataset/_p_Transcription_accuracy_on_clean_audio_using_Google_Speech-to-Text_p_/31051601
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Transcription accuracy on clean audio using Google Speech-to-Text.
应用场景:
创建时间:
2026-01-12
相关数据集
Trelis/chorus-v1-ami-2speaker-test-preds
重叠语音识别
语音识别评测
--- license: cc-by-4.0 tags: - predictions - multi-speaker - chorus - ami - benchmark source_datasets: - Trelis/ami-2speaker-test --- # Chorus v1 — Predictions on AMI 2-Speaker Test **Need a voice m
Hugging Face
2026-04-18 更新
5
0
AppTek Call-Center Dialogues
语音识别评测
对话分析
AppTek Call-Center Dialogues是由AppTek.ai构建的英语语音识别评测数据集,包含14种口音的自发性角色扮演客服对话。该数据集总计128.6小时音频,涉及156名说话者和16个服务场景,数据通过专业转录和严格质量审核流程生成。其特点是覆盖全球主流英语口音,保留对话中的不流畅现象和领域专有词汇,旨在解决长时对话ASR系统在多样化口音和真实交互场景下的评测难题。
arXiv
2026-04-30 更新
4
0
tuandung2812/central_ytb_scrape
语音识别评测
音频转录模型
该数据集包含音频文件及其对应的原始文本转录和多种语音识别模型的预测结果。音频采样率为16000Hz。数据集分为训练集(20502个样本)和测试集(1080个样本),每个样本包含唯一ID、音频数据、原始文本以及original_zipformer、finetuned_zipformer、elevenlabs、gpt和chunkformer五种模型的预测文本。
Hugging Face
2025-12-16 更新
4
0
Accuracy - Speech-Compare
语音识别评测
说话人验证
Accuracy - Speech-Compare
DataCite Commons
2021-12-26 更新
5
0
Trelis/eval-nova-3-medical-terms-2025-20260408-1929
语音识别
语音识别评测
--- tags: - whisper - evaluation - speech - speech-to-text --- # Evaluation Results: nova-3 Evaluation results from Whisper model evaluation. ## Summary | Model | WER | CER | |-------|-----|-----|
Hugging Face
2026-04-08 更新
4
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广