遇见数据集

正太角色语音标注训练数据

收藏
浙江省数据知识产权登记平台2026-08-25 更新2026-08-26 收录
官方服务:

资源简介:

本数据集聚焦正太角色语音合成与长篇叙事表达,核心解决少年叙事类高质量语音数据稀缺、正太音色可控生成及长篇语音连贯性等问题,通过专业录音棚采集的同一说话人(SPK010)语音及“少年感强度”三级标注,支撑模型在不同稚嫩程度下的精准合成控制。除内部训练外,该数据集可广泛复用于有声小说与广播剧的正太角色配音、游戏NPC差异化语音设计、动漫及二次元内容配音、虚拟主播/偶像的少年音色演绎、儿童故事与K12教育辅助朗读、个性化语音助手开发、影视动漫译制配音,以及语音合成模型微调与音色迁移等多元场景,为少年角色智能化应用提供高质量基准数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的正太角色叙事语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位男性说话人(SPK010)模拟正太人设的长篇灵异故事讲述,无预设脚本,要求保持“音色清亮、语速平缓”的少年感。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉角色配音的标注人员对每段语音进行精细化人工标注,针对正太角色特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留叙事语句及语气; 少年感强度分级:根据说话人的音色清亮度、语调稚嫩程度和咬字方式,将每段语音的少年感强度分为强、中、弱三级。该分级用于训练模型在不同少年感强度下的语音合成控制,提升正太角色的辨识度; 场景标注:统一标注场景为“正太”; 说话人属性:标注说话人标识(SPK010)及性别(男)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、少年感强度。 四、数据应用说明 本数据集可直接用于训练正太角色语音合成模型、长篇叙事语音生成系统等AI任务。数据集中每段语音均包含完整的转写文本及少年感强度标注,标注规范、结构清晰,可作为少年角色智能化应用的基准训练数据,尤其适用于有声小说角色配音、动漫游戏NPC语音生成及儿童故事自动朗读等垂直场景。

创建时间:
2026-06-24
搜集汇总
数据集介绍
正太角色语音标注训练数据 数据集图片
背景与挑战
背景概述
该数据集由专业录音棚采集,包含同一位男性说话人(SPK010)的正太角色长篇叙事语音,音频为48kHz采样率的WAV格式,并经过音量归一化等预处理。所有语音均配有逐字转写文本及“少年感强度”三级(强、中、弱)人工标注,结构化字段涵盖文件名、时长、场景等信息,数据总量约160MB。该数据集可用于正太角色语音合成模型训练、长篇叙事语音生成,并广泛适用于有声小说配音、游戏NPC语音设计、动漫配音及儿童故事朗读等场景。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务