genshin-voice
收藏资源简介:
该数据集是一个多字段语音数据集,包含音频文件及其对应的转录文本、说话人标识、说话人类型和样本类型。训练集包含146,339个样本,总数据量约为86GB。音频字段以未解码的二进制格式存储,转录文本为字符串类型。该数据集可适用于语音识别、说话人识别、说话人分类等任务。
This dataset is a multi-field speech dataset containing audio files along with their corresponding transcribed text, speaker identifiers, speaker types, and sample types. The training set consists of 146,339 samples with a total data volume of approximately 86GB. Audio fields are stored in undecoded binary format, while transcribed text is of string type. This dataset is suitable for tasks such as speech recognition, speaker recognition, and speaker classification.
数据集概述:genshin-voice
该数据集为《原神》游戏角色的语音数据集,由rijulpaul上传至Hugging Face平台,用于语音相关的研究与模型训练。
数据集基本信息
- 数据集名称:genshin-voice
- 数据集大小:约86.48 GB(下载大小86.48 GB,解压后大小86.48 GB)
- 样本数量:共146,339条训练样本
- 数据集格式:包含音频文件和对应的文本转录信息
数据特征字段
该数据集包含以下字段:
| 字段名 | 数据类型 | 说明 |
|---|---|---|
| audio | 音频 | 语音音频文件(未解码格式) |
| transcription | large_string | 音频对应的文本转录内容 |
| speaker | large_string | 说话人(角色)名称 |
| speaker_type | large_string | 说话人类型(如角色类型) |
| type | large_string | 数据类型或分类标签 |
数据划分
- 训练集(train):包含146,339条样本,占用空间86.48 GB
数据用途
该数据集适用于语音识别、语音合成、说话人识别、角色语音分析等任务,特别是针对《原神》游戏角色的语音处理相关研究。
注意:数据集中仅包含训练集划分,未提供验证集或测试集,用户需要根据需求自行划分数据。




