遇见数据集

抒情流行女声歌曲情感递进标注训练数据

收藏
浙江省数据知识产权登记平台2026-08-07 更新2026-08-08 收录
官方服务:

资源简介:

本数据集聚焦抒情流行女声歌曲在演唱过程中的情感动态递进建模,专门服务于情感可控歌声合成、音乐情感曲线分析、影视配乐情感自动适配等对情绪时变特征敏感的AI任务。抒情流行歌曲的情感表达随歌曲结构(主歌→预副歌→副歌)呈现“平缓→渐强→高潮”的清晰递进曲线,其情感细腻、旋律舒缓,对演唱力度和气息控制要求极高。现有歌声合成模型大多只能生成情感均匀的演唱,难以精准控制情感强度的动态变化,导致合成歌声缺乏感染力。本数据在专业录音棚采集女歌手演唱的抒情流行歌曲片段,涵盖慢板抒情、民谣风、轻摇滚等子风格,每段音频均有人工转写的歌词,并独创性地标注了每句/每段的情感递进阶段(平缓/渐强/高潮),同时记录对应的音量变化、气息强度等演唱参数。该数据集可用于训练能够感知并复现歌曲情感曲线的AI歌手模型,实现从“唱对音符”到“唱出情感”的跨越,特别适用于数字音乐内容生产、虚拟歌手个性化情感定制、音乐治疗中情绪引导音乐生成等垂直领域。 独立性与必要性 目前公开歌声数据集普遍缺乏针对抒情歌曲情感动态的精细化标注,本数据集填补了这一空白,具有独立存在价值,是推动情感化歌声合成技术发展的必要基础资源。 一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的抒情流行女声歌曲片段,均为WAV格式,采样率48kHz。录音环境强吸声、高信噪比,保证人声纯净。演唱者的演唱风格为抒情流行,无伴奏或含简易伴奏。预处理阶段,使用音频处理工具批量读取每段音频的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由专业音乐标注人员对每段音频进行精细化人工标注,针对抒情流行女声情感递进特点设计差异化标注方案: 歌词转写:将音频内容逐字转写为标准汉字歌词,准确记录歌词文字及断句位置; 情感递进标注:根据歌曲的情绪推进、音量变化和演唱力度,将每句或每段语音的情感递进分为平缓、渐强、高潮三类。 平缓:歌曲开头或过渡段落,音量较小,气息平稳,情感内敛; 渐强:情绪逐渐上升,音量增加,气息变强,常见于副歌前的铺垫; 高潮:情感最饱满,音量最大,演唱力度最强,对应副歌或情感爆发点。 标注时需结合整体歌曲结构(前奏→主歌→预副歌→副歌→尾声)进行判断,确保情感递进与歌曲发展逻辑一致。该标注用于训练模型在不同情感递进阶段下的歌声合成参数(如音量、气息、颤音强度)预测; 曲风标注:统一标注“抒情流行”; 演唱者属性:标注演唱者标识及性别(女)。 三、数据结构化 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段音频,字段包括:歌曲文件名、时长(秒)、采样率(kHz)、曲风、录制场景、演唱者、性别、类型、来源与授权、文本、情感递进。 四、数据应用说明 本数据集可直接用于训练抒情流行女声风格的情感可控歌声合成模型、音乐情感识别系统等AI任务。数据集中每段音频均包含完整的歌词转写及情感递进标注,标注规范、结构清晰,可作为情感化歌声合成智能化应用的基准训练数据。

创建时间:
2026-06-26
搜集汇总
数据集介绍
抒情流行女声歌曲情感递进标注训练数据 数据集图片
背景与挑战
背景概述
本数据集是杭州万像循声科技有限公司在专业录音棚录制的抒情流行女声歌曲片段,包含歌词转写和独创的情感递进标注(平缓/渐强/高潮),同时记录音量变化、气息强度等演唱参数。该数据集可用于训练情感可控歌声合成模型,支持音乐情感曲线分析、影视配乐情感适配等应用,旨在提升AI歌声的情感表现力。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务