遇见数据集

aztro/mabama-v

收藏
Hugging Face2024-04-22 更新2024-06-12 收录
官方服务:

资源简介:

该数据集主要用于文本到语音的任务,语言为西班牙语。数据集包含音频和文本特征,所有音频都由同一个说话者录制,具有相同的speaker_id。数据集分为训练集和验证集,每个集都包含音频、文本和speaker_id特征。

该数据集主要用于文本到语音的任务,语言为西班牙语。数据集包含音频和文本特征,所有音频都由同一个说话者录制,具有相同的speaker_id。数据集分为训练集和验证集,每个集都包含音频、文本和speaker_id特征。

提供机构:
aztro
原始信息汇总

数据集概述

基本信息

  • 许可证: MIT
  • 任务类别: 文本到语音
  • 语言: 西班牙语 (es)
  • 数据集名称: mabama-v
  • 大小: 10M<n<100M

特征详情

  • 音频 (audio)

    • 数据类型: 音频
  • 文本 (text)

    • 数据类型: 字符串
    • 路径: ./train.csv
  • 说话人ID (speaker_id)

    • 数据类型: 字符串
    • 描述: 所有音频中的唯一说话人标识。本数据集中的所有音频均来自同一人,且具有相同的说话人ID。
    • : mabama

数据分割

  • 训练集 (train)

    • 音频 (audio)
      • 数据类型: 音频
    • 文本 (text)
      • 数据类型: 字符串
      • 路径: ./train.csv
    • 说话人ID (speaker_id)
      • 数据类型: 字符串
      • 描述: 所有音频中的唯一说话人标识。本数据集中的所有音频均来自同一人,且具有相同的说话人ID。
      • : mabama
  • 验证集 (validation)

    • 音频 (audio)
      • 数据类型: 音频
    • 文本 (text)
      • 数据类型: 字符串
      • 路径: ./eval.csv
    • 说话人ID (speaker_id)
      • 数据类型: 字符串
      • 描述: 所有音频中的唯一说话人标识。本数据集中的所有音频均来自同一人,且具有相同的说话人ID。
      • : mabama
搜集汇总
数据集介绍
aztro/mabama-v 数据集图片
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务