Vyvo-Research/AST-Music-Data-291K
收藏资源简介:
# Speech-Music Merged Dataset ## Source Datasets | Dataset | Samples | Speech | Music | |---------|---------|--------|-------| | [AIGenLab/high-sound-and-low-music](https://huggingface.co/datasets/AIGenLab/high-sound-and-low-music) | 91,054 | 0 | 91,054 | | [AIGenLab/Speech_Dataset](https://huggingface.co/datasets/AIGenLab/Speech_Dataset) | 100,000 | 100,000 | 0 | | [AIGenLab/Music-Dataset](https://huggingface.co/datasets/AIGenLab/Music-Dataset) | 100,000 | 0 | 100,000 | | **TOTAL** | **291,054** | **100,000** | **191,054** | ## Dataset Info - Total Samples: **291,054** - Labels: `speech`, `music` - Audio: 16kHz, Mono, WAV ## Usage ```python from datasets import load_dataset dataset = load_dataset("AIGenLab/speech-music-merge", split="train") print(f"Total: {len(dataset):,} samples") ```
# 语音音乐合并数据集(Speech-Music Merged Dataset) ## 源数据集 | 数据集 | 样本总数 | 语音样本数 | 音乐样本数 | |---------|---------|--------|-------| | [AIGenLab/high-sound-and-low-music](https://huggingface.co/datasets/AIGenLab/high-sound-and-low-music) | 91,054 | 0 | 91,054 | | [AIGenLab/Speech_Dataset](https://huggingface.co/datasets/AIGenLab/Speech_Dataset) | 100,000 | 100,000 | 0 | | [AIGenLab/Music-Dataset](https://huggingface.co/datasets/AIGenLab/Music-Dataset) | 100,000 | 0 | 100,000 | | **总计** | **291,054** | **100,000** | **191,054** | ## 数据集信息 - 总样本数:**291,054** - 标签:`speech`、`music` - 音频参数:16kHz采样率,单声道,WAV格式 ## 使用方法 python from datasets import load_dataset dataset = load_dataset("AIGenLab/speech-music-merge", split="train") print(f"总计:{len(dataset):,} 个样本")



