儿歌女声歌曲活泼等级标注训练数据
收藏资源简介:
本数据集聚焦儿歌女声歌曲的活泼等级量化建模,服务于儿童AI教育产品、早教机语音合成、亲子互动App、儿歌自动生成等对童趣表现力有特殊要求的AI任务。儿歌的核心特征是旋律跳跃、节奏明快、咬字夸张,常用重复、拟声词和动作指令来吸引儿童注意力。现有歌声合成模型缺乏对“活泼程度”的量化标注,导致生成的儿歌往往“呆板无趣”或“过于单调”。本数据在专业录音棚采集专业儿歌歌手演唱的经典儿歌曲片段,涵盖律动儿歌、游戏儿歌、启蒙儿歌等类型,每段音频附人工转写的歌词,并标注活泼等级(轻松/活泼/欢腾)。该数据集可用于训练能够按需调节活泼程度的AI儿歌歌手,适用于儿童智能音箱、虚拟幼教老师、家庭陪伴机器人等垂直领域。 独立性与必要性 目前公开歌声数据集普遍缺乏针对儿歌活泼程度的标注,本数据集填补了这一空白,具有独立存在价值,是推动儿童AI音乐教育、智能化儿歌创作的重要基础资源。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的儿歌女声歌曲片段,均为WAV格式,采样率48kHz。演唱者为专业儿歌歌手(女),涵盖经典儿歌、原创儿歌等。预处理阶段,使用音频处理工具批量读取时长,统一命名,进行音量归一化、静音段切除等标准化处理。 二、特征标注 由专业音乐标注人员对每段音频进行精细化人工标注,针对儿歌女声特点设计差异化标注方案: 歌词转写:逐字转写为标准汉字歌词,保留拟声词、叠词和动作提示; 活泼等级标注:根据歌曲的节奏速度、旋律跳跃幅度、咬字夸张程度、情绪饱满度,将活泼等级分为轻松、活泼、欢腾三级。 轻松:节奏舒缓,旋律平稳,咬字清晰但无夸张,情绪温和,如摇篮曲、慢速启蒙歌; 活泼:节奏明快,有旋律起伏,咬字略带夸张,情绪积极,如律动游戏歌; 欢腾:节奏极快,旋律跳跃大,咬字夸张,伴有大量拟声词和动作指令,情绪高涨,如狂欢儿歌。 该标注用于训练模型在不同活泼等级下的歌声合成参数(节奏偏移、音高波动、发音力度)预测; 曲风标注:统一标注“儿歌”; 演唱者属性:标注演唱者标识及性别。 三、数据结构化与打包 将技术参数与标注结果汇总为结构化表格文件,字段包括:歌曲文件名、时长(秒)、采样率(kHz)、曲风、录制场景、演唱者、性别、类型、来源与授权、文本、活泼等级。 四、数据应用说明 本数据集可直接用于训练儿歌女声风格的活泼等级可控歌声合成模型、早教AI语音助手、儿童音乐教育应用等AI任务。




