相关数据集
Multi-Talker-SD
Multi-Talker-SD是一个大规模双语(英语-普通话)多说话人会议数据集,旨在支持说话人日志和会议转录研究。该数据集包含1000个模拟会议,每个会议有10-30名参与者,平均对话时长约20分钟,捕捉了真实的说话人重叠、轮流模式和跨语言交互。音频使用AIShell-1和LibriSpeech的话语合成,结合混响和噪声注入生成高保真多说话人录音。数据集还包括详细的说话人元数据,如性别、语言、会
github2025-09-17 更新610
tts-rj-hi-karya-44100hz-part-26-quality
该数据集包含了文本、语音文件名、语音信号处理相关的多个特征,如平均音高、音高标准差、信噪比、c50值、说话速率、音素,以及用于评估语音质量的stoi、si-sdr和pesq指标。数据集分为训练集,提供了每个部分的字节大小和示例数量。默认配置下,训练集的数据文件路径已指定。
Hugging Face2025-03-29 更新70
Identification of Beehive Piping Audio Signals
We introduce a novel dataset of bee piping audio signals which was built by collecting 44 different recordings which were published by various beekeepers on the YouTube platform.Each recording has a d
DataCite Commons2021-10-04 更新70
BeepBank-500
BeepBank-500是一个紧凑的、完全合成的耳标/警报数据集,包含300-500个片段,旨在为人类计算机交互和音频机器学习中的快速、无版权限制的实验而设计。每个片段都由参数化配方生成,控制波形族、基频、持续时间、振幅包络、振幅调制和轻量级Schroeder式混响。数据集的目标任务包括耳标分类、音色分析和起始检测,拥有明确的许可和限制。音频通过CC0-1.0专用于公有领域;代码在MIT许可下。
arXiv2025-09-22 更新200
Research Data Supporting "Tests for separability in nonparametric covariance operators of random surfaces"
#### Software - covsep-1.0.1.tar.gz : R package implementing the methodology of the paper. #### Data for reproducing the Numerical simulations: - reproduce-sims.R: R script to reproduce the simulation
DataCite Commons2020-07-27 更新70



