PRE_DB
收藏资源简介:
DialBGM 是一个用于促进对话上下文理解和背景音乐推荐研究的数据集。该数据集专注于日常多轮对话场景,要求模型根据对话的上下文推理并选择合适的背景音乐。数据集包含 1,200 个精心挑选的样本,每个样本包括一个多轮对话、一组候选音乐片段及其文本元数据,以及一个排名标注,指示每个候选音乐对给定对话上下文的相对适合性。数据集支持对话感知音乐推荐和排名系统的基准测试与分析,以及语言和音乐描述之间的多模态推理研究。数据以 JSON 格式提供,每个样本包含对话摘要、对话轮次、音乐排名及候选音乐的详细信息(如名称、描述和音乐特征标签)。数据集适用于非商业用途,遵循 CC BY-NC-SA 4.0 许可。
DialBGM is a dataset curated to facilitate research on conversational context understanding and background music recommendation. Focusing on daily multi-turn dialogue scenarios, this dataset tasks models with inferring and selecting appropriate background music based on the conversational context. It contains 1,200 meticulously curated samples, each consisting of a multi-turn dialogue, a collection of candidate music clips alongside their textual metadata, and a ranking annotation that specifies the relative suitability of each candidate music piece for the provided conversational context. This dataset enables benchmarking and analysis for dialogue-aware music recommendation and ranking systems, as well as multimodal reasoning research exploring the alignment between language and music descriptions. The dataset is distributed in JSON format, where each sample includes a dialogue summary, dialogue turns, music ranking annotations, and detailed information of candidate music such as its name, description, and music feature tags. The dataset is permitted for non-commercial use and is released under the CC BY-NC-SA 4.0 license.
PRE_DB (DialBGM) 数据集概述
数据集基本信息
- 数据集名称: DialBGM (PRE_DB)
- 创建者: SLPR Lab / JoonHyeok Shin, Jaehoon Kang, Yu Jun Lee, Hanna Lee, Yejin Lee, Kyuhong Shim
- 语言: 英语 (en)
- 许可协议: CC BY-NC-SA 4.0
- 数据规模: 1,200 个样本 (1K<n<10K)
数据集简介
DialBGM 是一个对话条件背景音乐推荐数据集,旨在促进对对话上下文理解和选择合适背景音乐的研究。该数据集专注于日常多轮对话场景,要求模型能够推理对话的演变上下文,并对多个候选音乐片段进行比较。
数据集用途
直接用途
该数据集可用于以下研究:
- 为多轮对话选择合适音乐的模型的基准测试和评估。
- 分析多轮对话上下文与音乐特征之间的关系。
- 对文本(对话)和音乐元数据(描述和方面)进行多模态推理。
超出范围的用途
- 由于采用 CC BY-NC-SA 4.0 许可协议,禁止任何商业用途。
数据结构
数据集以 JSON 文件形式提供。每个样本是一个包含以下字段的 JSON 对象:
| 字段 | 类型 | 描述 |
|---|---|---|
id |
int | 样本的唯一标识符。 |
dialog_one_liner |
string | 对话的单行摘要。 |
dialog_turns |
list[string] | 按时间顺序排列的、构成多轮对话的话语列表。 |
ranking |
list[string] | 音乐键列表(例如 ["C", "D", "A", "B"]),表示候选音乐从最佳到最差的偏好顺序。 |
music |
dict | 一组由键 A、B、C 和 D 索引的候选音乐项。 |
music.name |
string | 音乐片段的标识符(例如 [YouTubeID]-[start-end].wav)。 |
music.caption |
string | 来自 MusicCaps 的音乐片段的文本描述。 |
music.aspect_list |
list[string] | 描述音乐特征方面的标签列表。 |
数据来源
DialBGM 通过结合以下两个公共数据集创建:
- DailyDialog (多轮对话来源,CC BY-NC-SA 4.0): https://huggingface.co/datasets/roskoN/dailydialog
- MusicCaps (音乐描述和方面来源,CC BY-SA 4.0): https://huggingface.co/datasets/google/MusicCaps
来自 DailyDialog 的对话与来自 MusicCaps 的音乐元数据配对,并添加了排名注释以指示哪种音乐最适合每个对话上下文。
偏见、风险与局限性
- 该数据集仅用于非商业用途,遵循从 DailyDialog 继承的 CC BY-NC-SA 4.0 许可协议。
- 数据集继承了其源数据集 DailyDialog 和 MusicCaps 的偏见和覆盖范围限制。
- 数据集规模相对较小,不适用于直接部署到生产或商业系统中。
引用
如果此数据集对您的研究有帮助,请考虑引用:
@article{dialbgm2026, title = {DialBGM: A Dialogue-Conditioned Background Music Recommendation Dataset}, author = {SKKU SLPR Lab}, journal = {arXiv preprint arXiv:XXXX.XXXXX}, year = {2026} }




