登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
20小时美国英语男声合成库
20小时美国英语男声合成库
收藏
江苏数据交易所
2026-01-30 收录
语音合成
语音数据集
数据链接:
https://exchange.jsdataex.com/trade-home/#/project/tradingMarket/productDetail?productId=933
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
本套数据美国英语男声合成库由美国母语发音人参与录制,发音纯正,语料音素覆盖均衡,专业语音学家参与标注,精准匹配语音合成的研发需求。
应用场景:
提供机构:
苏州数据资产运营有限公司
搜集汇总
背景与挑战
背景概述
该数据集是一个20小时的美国英语男声语音合成库,由美国母语发音人录制,发音纯正且语料音素覆盖均衡。专业语音学家参与标注,确保数据精准匹配语音合成的研发需求,适用于高质量的语音合成模型训练。
以上内容由遇见数据集搜集并总结生成
相关数据集
mms-tts-uig-script_latin-UQSpeech3
语音合成
语音识别
该数据集包含音频文件路径和对应的句子文本。音频文件的采样率为16000Hz,句子文本为字符串类型。数据集包含一个训练集,共有7600个样本,总大小为2336113594.4字节。数据集的下载大小为2133532693字节。训练集的数据文件路径为'data/train-*'。
Hugging Face
2025-01-21 更新
45
0
D343_Chinese_Mandarin_Multi_emotional_Synthesis_Corpus
语音合成
情感识别
20人中文多情感合成库,由中文母语发音人录制,覆盖不同年龄段音色和性别。七种情感文本,文本均来自于小说,语料音素覆盖均衡,专业语音学家参与标注,精准匹配语音合成的研发需求。共计57.3小时。
OpenCSG
2026-03-04 更新
11
0
Cintin/jenny-tts-6h-tagged
语音转文本
语音合成
--- dataset_info: features: - name: file_name dtype: string - name: text dtype: string - name: transcription_normalised dtype: string - name: utterance_pitch_mean dtype: floa
Hugging Face
2024-05-22 更新
9
0
nineninesix/jinsaryko-tifa-en-nano-codec-dataset
语音合成
语音识别
Tifa EN Nano-Codec数据集是基于Tifa数据集使用NVIDIA的NeMo音频编解码器进行重新编码得到的,包含纳米级音频标记。该数据集旨在用于微调多模态大型语言模型(LLM)和语音系统(TTS/ASR),这些系统依赖于基于编解码器的音频标记表示。数据集包括发音转录、说话者标识、四层量化音频表示和编码音频标记的序列长度。
Hugging Face
2025-09-20 更新
13
0
ilsp/aperathiot-speech-corpus
语音识别
语音合成
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: raw_text dtype: string - name: normalized_text dtype: string - name: speaker_id
Hugging Face
2025-12-30 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广