mclemcrew/MixologyDB
收藏资源简介:
该数据集旨在推动智能音乐制作领域的发展,特别是针对数字音频工作站(DAW)中的音乐混音。数据集包含114个混音实例,每个实例包含混音名称、歌曲名称、艺术家名称、流派、音轨、音轨名称、音轨类型、音轨音频路径、通道模式、参数、增益、声像等信息。数据集的收集过程涉及手动注释每个音轨的参数值,并使用工具估计插件参数值。数据集通过HuggingFace分发,采用MIT许可证,无版权限制。
This dataset was created to advance the field of intelligent music production, specifically for music mixing in digital audio workstations (DAWs). It contains annotated mixes from Logic Pro, Pro Tools, or Reaper, with each mix including details like mix name, song name, artist name, genre, tracks, track name, track type, track audio path, channel mode, parameters, gain, pan, etc. The dataset is funded by the National Science Foundation Graduate Research Fellowship Program. The data collection process involved manual annotation of parameter values for each track in the mix. The dataset is distributed via HuggingFace under the MIT license and is maintained by Michael Clemens. The dataset aims to provide an ethical source repository for AI music researchers.
数据集概述
数据集创建动机
- 目的:该数据集旨在推动智能音乐制作领域的发展,特别是针对数字音频工作站(DAW)中的音乐混音。
- 潜在用途:可能用于通过混合听觉评估提供的语义标签预测参数值。
- 资金支持:由国家科学基金会研究生研究奖学金计划(Award Abstract # 1650114)资助。
数据集组成
- 实例类型:数据集包含来自Logic Pro、Pro Tools或Reaper的独立混音的注释。
- 实例数量:最终将包含114个混音。
- 实例内容:每个混音实例包含混音名称、歌曲名称、艺术家名称、流派、轨道、轨道名称、轨道类型、轨道音频路径、通道模式、参数、增益、声像等。
- 外部资源:混音关联的音频文件来自外部资源,如The Mixing Secrets、Weathervane或The Open Multitrack Testbed。
数据收集过程
- 收集方式:数据通过手动注释每个混音中的参数值收集,使用Logic Pro、Pro Tools或Reaper的项目文件。
- 收集时间:数据收集于2023年9月至11月。
- 数据来源:数据直接从每个混音的会话文件中获取,参数值通过视觉表示在插件中。
数据预处理
- 预处理步骤:在数据收集阶段进行预处理,使用工具估计插件制造商隐藏的参数值。
- 原始数据保存:原始数据保存在项目文件中,但未包含在数据集中。
- 预处理工具:用于注释参数值的工具可从此处下载。
数据集分布
- 分布方式:数据集通过HuggingFace分发,并由University of Utah的Box账户进行冗余存档。
- 发布时间:数据集将于2023年12月5日完整发布。
- 许可:数据集将通过MIT许可证分发,无版权限制。
数据集维护
- 维护者:数据集由Michael Clemens(邮箱:michael.clemens at utah.edu)维护,托管于HuggingFace。
- 更新计划:更新和修订将通过HuggingFace仓库记录。
法律与伦理考虑
- 合规性:数据集符合欧盟通用数据保护条例(GDPR)等相关法律。
- 伦理审查:由于数据集是Brecht De Man等人主要数据集的扩展,且数据不涉及音乐制作人,因此未进行IRB审查。




