登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
argmaxinc/common_voice_17_0-argmax_subset-400
argmaxinc/common_voice_17_0-argmax_subset-400
收藏
Hugging Face
2024-09-27 更新
2025-04-08 收录
数据链接:
https://hf-mirror.com/datasets/argmaxinc/common_voice_17_0-argmax_subset-400
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc0-1.0 ---
许可证:CC0 1.0
应用场景:
提供机构:
argmaxinc
相关数据集
argmaxinc/whisperkit-evals
自动语音识别
模型评估
`librispeech`数据集包含5小时的短音频片段,用于测试短文本转录质量;`earnings22`数据集包含120小时的英语收益电话录音,用于测试长文本转录质量。
Hugging Face
2025-02-17 更新
33
0
argmaxinc/earnings22-kws-golden
语音识别
关键词提取
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: file_id dtype: string - name: transcript list: string - name: text dtype: s
Hugging Face
2025-11-06 更新
12
0
argmaxinc/common_voice_17_0-argmax_subset-400-openbench
语音识别
语音合成
该数据集包含音频文件及其相关转录文本和元数据。每个音频文件具有16000 Hz的采样率,并附带持续时间、转录文本、语言信息、来自Common Voice 17.0数据集的语言代码和唯一的音频ID。数据集分为不同的配置(config_name),例如af、am、ar等,每个配置的测试分割包含指定数量的示例和文件大小。还提供了数据集的总大小和下载大小。
Hugging Face
2025-07-18 更新
9
0
argmaxinc/whisperkit-evals_01-30-24
自动语音识别
模型优化
该数据集主要用于评估WhisperKit ASR(自动语音识别)系统的性能,特别是基于`librispeech`数据集的评估。评估内容包括不同WhisperKit模型及其优化变体的词错误率(WER)、推理质量(QoI)和文件大小。此外,还比较了不同项目(如WhisperKit、WhisperCpp、WhisperMLX)在使用`openai_whisper-large-v3`模型时的表现。评估结果
Hugging Face
2024-02-23 更新
15
0
argmaxinc/librispeech-openbench
语音识别
这个数据集包含了两种配置的音频数据,分别为200和full。每种配置都包括音频文件、音频持续时间、音频的文本转录和音频的唯一标识符。音频采样率为16000Hz。数据集分为测试集,其中200配置的测试集包含200个示例,而full配置的测试集包含2620个示例。数据集的总大小和下载大小也有所不同。
Hugging Face
2025-07-18 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广