登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
AudioX 语音克隆与语音生成
AudioX 语音克隆与语音生成
收藏
华为云市场
2026-01-05 更新
2025-03-23 收录
语音克隆
语音合成
数据链接:
https://marketplace.huaweicloud.com/contents/01d57b00-007c-420c-9366-57b3558293c5
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
高感情、超拟人的AI语音克隆和语音合成,和真人语音听感高度一致;克隆一种语言,即可保留原说话人的音色特征,输出多种语言的语音。
应用场景:
提供机构:
北京深度逻辑智能科技有限公司
创建时间:
2025-03-18
相关数据集
mms-tts-uig-script_latin-UQSpeech3
语音合成
语音识别
该数据集包含音频文件路径和对应的句子文本。音频文件的采样率为16000Hz,句子文本为字符串类型。数据集包含一个训练集,共有7600个样本,总大小为2336113594.4字节。数据集的下载大小为2133532693字节。训练集的数据文件路径为'data/train-*'。
Hugging Face
2025-01-21 更新
45
0
D343_Chinese_Mandarin_Multi_emotional_Synthesis_Corpus
语音合成
情感识别
20人中文多情感合成库,由中文母语发音人录制,覆盖不同年龄段音色和性别。七种情感文本,文本均来自于小说,语料音素覆盖均衡,专业语音学家参与标注,精准匹配语音合成的研发需求。共计57.3小时。
OpenCSG
2026-03-04 更新
11
0
Cintin/jenny-tts-6h-tagged
语音转文本
语音合成
--- dataset_info: features: - name: file_name dtype: string - name: text dtype: string - name: transcription_normalised dtype: string - name: utterance_pitch_mean dtype: floa
Hugging Face
2024-05-22 更新
9
0
nineninesix/jinsaryko-tifa-en-nano-codec-dataset
语音合成
语音识别
Tifa EN Nano-Codec数据集是基于Tifa数据集使用NVIDIA的NeMo音频编解码器进行重新编码得到的,包含纳米级音频标记。该数据集旨在用于微调多模态大型语言模型(LLM)和语音系统(TTS/ASR),这些系统依赖于基于编解码器的音频标记表示。数据集包括发音转录、说话者标识、四层量化音频表示和编码音频标记的序列长度。
Hugging Face
2025-09-20 更新
13
0
ilsp/aperathiot-speech-corpus
语音识别
语音合成
--- dataset_info: features: - name: audio dtype: audio: sampling_rate: 16000 - name: raw_text dtype: string - name: normalized_text dtype: string - name: speaker_id
Hugging Face
2025-12-30 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广