登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Jocko Podcast
Jocko Podcast
收藏
kaggle
2023-01-13 更新
2024-03-08 收录
播客
语音识别
数据链接:
https://www.kaggle.com/datasets/ragnarstefansson/jocko-podcast
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Transcripts from Jocko Podcast using OpenAI Whisper
采用OpenAI Whisper生成的约科播客(Jocko Podcast)转录文本
应用场景:
创建时间:
2023-01-05
相关数据集
Nexdata/accented_english
语音识别
多语言口语
--- YAML tags: - copy-paste the tags obtained with the tagging app: https://github.com/huggingface/datasets-tagging task_categories: - automatic-speech-recognition language: - en --- # Dataset Card f
Hugging Face
2023-11-22 更新
112
0
filipinospeechcorpus
语音识别
语音合成
菲律宾语音语料库(Filipino Speech Corpus, FSC)是一个用于自动语音识别(ASR)和文本转语音(TTS)任务的句子级语音数据集。该数据集以Hugging Face Parquet格式存储,包含16kHz单声道音频片段。数据集总大小约为6GB,由139个分片组成。每个样本包含音频文件、对应的文本转录、音频时长、单词数量、说话者ID、性别、年龄组、语音类型(朗读/自发/机器生成
Hugging Face
2026-03-22 更新
24
0
minato-ryan/emilia-cjk-xcodec2
语音识别
日语处理
该数据集包含多个配置(ja_long,ja_short,ja_skipped,ja_very_long),每个配置都有如uid、dnsmos、时长、语言、说话人、文本、wav文件和ids等特征。每个配置的训练分割都包含了示例数量和字节数的信息。此外,还提供了每个配置的下载大小和数据集大小。
Hugging Face
2025-10-24 更新
11
0
glenn2/voice_breaths
语音识别
音频分析
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 48000 - name: sentence dtype: string splits: - name: train num_bytes: 55098221109.05 num_
Hugging Face
2024-04-13 更新
28
0
cmu-mlsp/librispeech960-wavlm-large-km1000_asr_tokenized_final
语音识别
自然语言处理
--- configs: - config_name: default data_files: - split: train path: data/train-* - split: validation path: data/validation-* - split: validation_tts path: data/validation_tts-*
Hugging Face
2023-12-05 更新
20
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广