数据链接:
官方服务:
资源简介:
DIHARD track1 ws-cr system (no R)
应用场景:
创建时间:
2020-01-24
相关数据集
Multi-Talker-SD
Multi-Talker-SD是一个大规模双语(英语-普通话)多说话人会议数据集,旨在支持说话人日志和会议转录研究。该数据集包含1000个模拟会议,每个会议有10-30名参与者,平均对话时长约20分钟,捕捉了真实的说话人重叠、轮流模式和跨语言交互。音频使用AIShell-1和LibriSpeech的话语合成,结合混响和噪声注入生成高保真多说话人录音。数据集还包括详细的说话人元数据,如性别、语言、会
github2025-09-17 更新610
magicdata-ramc
为了进一步丰富开源语音语料库,促进语音语言处理技术的发展,Magic Data联合中科院声学研究所、上海交通大学和西北工业大学,在Magichub开源社区正式开源180小时中文对话式语音数据集MagicData-RAMC。MagicData-RAMC是一批高质量且标注丰富的训练数据,可以很好地支持开发者完成语音识别和说话人日志相关的研究。数据集下载地址https://magichub.com/da
IEEE510
arda-argmax/simchoir-parquet
FastMSS合成的多说话人会议数据集(parquet版)是一个流式友好的parquet分片数据集,包含合成的多说话人对话语料库。每行数据包含内联嵌入的音频字节(16 kHz单声道WAV)、每个片段的说话人日志时间戳、逐字转录以及完整的lhotse cut JSON blob。数据集适用于自动语音识别(ASR)、语音活动检测(VAD)和说话人日志(diarization)任务。数据集包含多个子集(
Hugging Face2026-04-30 更新50



