登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
nguyenvulebinh/fsd50k
nguyenvulebinh/fsd50k
收藏
Hugging Face
2022-05-08 更新
2024-03-04 收录
数据链接:
https://hf-mirror.com/datasets/nguyenvulebinh/fsd50k
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
--- license: cc-by-4.0 ---
应用场景:
提供机构:
nguyenvulebinh
原始信息汇总
数据集概述
许可证信息
许可证类型:CC-BY-4.0
描述:该数据集遵循知识共享署名4.0国际许可协议。
相关数据集
nguyenvulebinh/libris_clean_100
语音识别
自然语言处理
LibriSpeech是一个包含约1000小时16kHz英语朗读语音的语料库,数据来源于LibriVox项目的有声读物,并经过仔细的分段和对齐处理。数据集支持自动语音识别(ASR)和音频说话人识别任务,并提供了两个配置:clean和other。数据集的结构包括音频文件路径、音频数据、文本转录、说话人ID、章节ID和唯一ID等信息。数据集分为训练集、验证集和测试集,训练集进一步分为train.100
Hugging Face
2022-12-06 更新
176
0
nguyenvulebinh/asr-alignment
自动语音识别
文本对齐
该数据集是多个广泛使用的ASR数据集的变体,包括Librispeech、MuST-C、TED-LIUM、VoxPopuli、Common Voice和GigaSpeech。与原始数据集不同的是,该数据集包含了音频和文本之间的精确对齐、标点符号和大小写敏感的文本,以及文本中命名实体的识别。
Hugging Face
2024-01-08 更新
14
0
nguyenvulebinh/spoken_norm_pattern
自动语音识别
文本规范化
越南语逆向文本归一化(ITN)数据集用于将口语风格转换为书面风格,特别是在自动语音识别(ASR)系统中,以提高输出的可读性。数据集包含时间、日期、数字和度量单位、电话号码等多种类型的示例。数据集分为训练集、验证集和测试集,分别包含500,000、2,500和2,500个实例。
Hugging Face
2022-09-28 更新
9
0
nguyenvulebinh/libris-asr-alignment
语音识别
音视频文本对齐
--- dataset_info: - config_name: default features: - name: id dtype: string - name: text dtype: string - name: audio dtype: audio: sampling_rate: 16000 - name: word
Hugging Face
2024-01-04 更新
14
0
nguyenvulebinh/wham
音频处理
--- dataset_info: features: - name: utterance_id dtype: string - name: noise_file dtype: string - name: audio dtype: audio splits: - name: train num_bytes: 4743740197.0
Hugging Face
2023-05-02 更新
13
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广