登录后查看消息通知
遇见数据集
杭州万像循声科技有限公司

杭州万像循声科技有限公司

企业

杭州万像循声科技有限公司围绕相关业务开展运营。面向国风音乐分类、配乐智能推荐、音乐情绪分类等领域提供数据服务,开放国潮中国风配乐特征标注训练数据(国风音乐分类、配乐智能推荐)、温暖治愈配乐特征标注训练数据(音乐情绪分类、智能配乐检索)、传统中国风配乐特征标注训练数据(音乐情感分类、传统中国风配乐检索),支撑模型训练与算法优化。

国风音乐分类配乐智能推荐音乐情绪分类
成立于 2021 年浙江省642266231@qq.com

数据概览

53
数据集总量
106
总浏览量
0
关注人数
2026-08-26
最近更新
分类统计

相关机构

  • 铨
    铨盛聚碳科技股份有限公司
    拥有数据集:3个
    企业
  • 湖
    湖北汉江之星科技有限公司
    拥有数据集:3个
    企业
  • 深
    深圳市智搜信息技术有限公司
    拥有数据集:3个
    企业
  • 盐
    盐城兴北实业投资有限公司
    拥有数据集:3个
    企业
  • 航
    航天万源云数据河北有限公司
    拥有数据集:3个
    企业

数据集列表

正太角色语音标注训练数据
正太角色语音合成
少年感语音标注
本数据集聚焦正太角色语音合成与长篇叙事表达,核心解决少年叙事类高质量语音数据稀缺、正太音色可控生成及长篇语音连贯性等问题,通过专业录音棚采集的同一说话人(SPK010)语音及“少年感强度”三级标注,支撑模型在不同稚嫩程度下的精准合成控制。除内部训练外,该数据集可广泛复用于有声小说与广播剧的正太角色配音、游戏NPC差异化语音设计、动漫及二次元内容配音、虚拟主播/偶像的少年音色演绎、儿童故事与K12教育辅助朗读、个性化语音助手开发、影视动漫译制配音,以及语音合成模型微调与音色迁移等多元场景,为少年角色智能化应用提供高质量基准数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的正太角色叙事语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位男性说话人(SPK010)模拟正太人设的长篇灵异故事讲述,无预设脚本,要求保持“音色清亮、语速平缓”的少年感。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉角色配音的标注人员对每段语音进行精细化人工标注,针对正太角色特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留叙事语句及语气; 少年感强度分级:根据说话人的音色清亮度、语调稚嫩程度和咬字方式,将每段语音的少年感强度分为强、中、弱三级。该分级用于训练模型在不同少年感强度下的语音合成控制,提升正太角色的辨识度; 场景标注:统一标注场景为“正太”; 说话人属性:标注说话人标识(SPK010)及性别(男)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、少年感强度。 四、数据应用说明 本数据集可直接用于训练正太角色语音合成模型、长篇叙事语音生成系统等AI任务。数据集中每段语音均包含完整的转写文本及少年感强度标注,标注规范、结构清晰,可作为少年角色智能化应用的基准训练数据,尤其适用于有声小说角色配音、动漫游戏NPC语音生成及儿童故事自动朗读等垂直场景。
浙江省数据知识产权登记平台2026-08-25 更新00
有声小说自然对话语音标注训练数据
有声小说口语语音合成
自然对话语音标注
本数据集聚焦有声小说朗读者在专业录音棚中录制的自然对话语音,属于有声小说背景下的口语语料,服务于社交语音分析、智能客服、闲聊机器人、有声创作者的口语风格研究等场景。说话人为一位男性有声小说朗读者,语音内容为无脚本日常闲聊,涵盖宿舍生活、节日聚会、星座命理、校园趣事等话题,口语特征鲜明(频繁使用“嗯”、“然后”、“就是说”等语气词,存在重复、自我修正)。每段语音均附有人工转写,完整保留真实口语的无脚本表达。该数据集的说话人具有有声小说朗读的专业发声习惯(声音共鸣、咬字清晰),但内容为即兴口语,兼具广播腔的质感与日常聊天的松弛感,具有独特的声学特征。 独立性与必要性 本数据集的独特性在于:说话人既是专业朗读者(音色、气息、咬字均优于普通人),又完全以自然口语方式交谈,这种“半专业”声线对于训练具有亲和力又清晰耐听的语音合成模型具有重要价值。该数据集在语音合成领域具有不可替代的应用潜力。
浙江省数据知识产权登记平台2026-08-20 更新10
上海话方言语音标注训练数据
上海话语音识别
方言语音标注
本数据集聚焦上海话方言的语音识别与自然口语理解。上海话是吴语太湖片的代表,在本地智能客服、社区服务、文化传承等领域有强烈需求。现有普通话语音模型无法处理上海话的浊音声母、入声及连续变调。本数据在专业录音棚采集一位上海本地男性说话人的自然口语叙事,每段语音均附有人工汉字转写,并标注浊音声母清晰度(高/中/低),完整保留上海话特有词汇及语序。 独立性与必要性 本数据集的特征——真实口语化表达、话题自然流转、包含丰富的浊音声母与语气词——是训练面向上海地区智能化语音系统的关键资源。目前公开发音的上海话语料较为稀缺,本数据集填补了这一空白,具有明确的独立存在价值,是推动上海话语音识别、方言保护及本地化人机交互的必要基础数据。 一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的上海话自然口语叙事语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位上海本地男性说话人的自发独白叙事,内容覆盖日常叙事类话题,无预设脚本干预。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由精通上海话的专业标注人员对每段语音进行精细化人工标注,针对上海话特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留上海话特有词汇及特有句式,必要时用助词体现语气,确保转写文本忠实反映方言发音与用词习惯; 浊音声母清晰度分级:根据语音中浊音声母(如“b、d、g、z、v”等)的发音清晰度(是否低沉有力、声带振动明显),将每段语音的浊音声母清晰度分为高、中、低三级,用于训练模型在不同浊音保存度下的方言识别能力; 场景标注:根据内容统一标注场景为“上海话”; 说话人属性:标注说话人性别(男)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、浊音声母清晰度。 四、数据应用说明 本数据集可直接用于训练上海话方言场景下的语音识别模型、口语语义理解模型、方言语音合成系统等AI任务。数据集中每段语音均包含完整的转写文本及浊音声母清晰度标注,标注规范、结构清晰,可作为上海话智能化应用的基准训练数据,尤其适用于上海地区的智能客服、本地化语音助手、社区便民服务以及方言文化数字化保护等垂直场景。
浙江省数据知识产权登记平台2026-08-15 更新60
暖男角色语音标注训练数据
暖男角色语音合成
情感语音交互
本数据集聚焦暖男角色语音合成与情感交互,服务于有声小说、虚拟伴侣、游戏NPC、情感陪伴类AI等场景。暖男角色语音特征为语调温柔、语气体贴、常用宠溺与安慰式表达。本数据在专业录音棚采集一位男性说话人模拟暖男人设的自然对话,涵盖日常关怀、情感安慰、生活陪伴等丰富场景,每段语音附人工转写,并标注情感支持类型(安慰/鼓励/陪伴),完整保留暖男特有的温暖体贴式话术及关切语气。 独立性与必要性 本数据集的特征——语调温柔、语气体贴、宠溺与安慰并存——是训练暖男角色语音合成的关键资源。目前面向温柔型男性人设的高质量语音语料较为稀缺,本数据集填补了这一空白,具有明确的独立存在价值,是推动暖男角色语音合成、虚拟伴侣互动、情感陪伴AI及有声内容角色配音的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的暖男角色扮演语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位男性说话人(VRT001)模拟暖男人设的自发对话,话题涵盖日常关怀、情感安慰、工作生活等,要求说话人保持“语调温柔、语气体贴”的暖男音色,无预设脚本。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉角色配音的标注人员对每段语音进行精细化人工标注,针对暖男角色特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留暖男特有的安慰式、宠溺式词汇及句式,忠实记录语气词及情感表达; 情感支持类型标注:根据语句的语用功能和情感倾向,将每句语音的情感支持类型分为安慰、鼓励、陪伴三类。该分类用于训练模型在不同情感支持类型下的语音合成控制,提升暖男角色的共情能力; 场景标注:统一标注场景为“暖男”; 说话人属性:标注说话人标识(VRT001)及性别(男)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、情感支持类型。 四、数据应用说明 本数据集可直接用于训练暖男角色语音合成模型、角色情感语音识别系统、情感陪伴AI引擎等AI任务。数据集中每段语音均包含完整的转写文本及情感支持类型标注,标注规范、结构清晰,可作为暖男人设智能化应用的基准训练数据,尤其适用于有声小说角色配音、虚拟男友/伴侣、游戏NPC语音生成及情感关怀类语音交互等垂直场景。
浙江省数据知识产权登记平台2026-08-14 更新10
御姐角色语音标注训练数据
御姐角色语音合成
情感语音交互
本数据集聚焦御姐角色语音合成与情感交互,服务于有声小说、广播剧、虚拟偶像、游戏NPC、职场助手等场景。御姐角色语音特征为音调略低、语速平稳、语气成熟自信,常有调侃、宠溺、冷静命令式表达。通用语音模型难以精准还原御姐的从容感与轻微慵懒。本数据在专业录音棚采集一位女性说话人模拟御姐人设的自然对话,涵盖工作指导、情感交流、日常调侃、生活建议等丰富场景,每段语音附人工转写,并标注情感强度分级(轻度/中度/重度),完整保留御姐特有的调侃式、宠溺式话术及成熟冷静的语气。 独立性与必要性 本数据集的特征——中低音调、平稳语速、宠溺与冷静并存——是训练御姐角色语音合成的关键资源。目前面向成熟女性人设的高质量语音语料较为稀缺,本数据集填补了这一空白,具有明确的独立存在价值,是推动御姐角色语音合成、有声内容角色配音及虚拟形象互动的重要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的御姐角色扮演语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位女性说话人(VRT014)模拟御姐人设的自发对话,话题涵盖工作、情感、日常调侃等,要求说话人保持“音调略低、语速平稳、成熟自信”的御姐音色,无预设脚本。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉角色配音的标注人员对每段语音进行精细化人工标注,针对御姐角色特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留御姐特有词汇及调侃式、冷静命令式句式; 情感强度分级:根据说话人的语气强弱、用词力度和情感浓度,将每句语音的情感表达分为轻度、中度、重度三级。轻度对应平淡陈述或轻微情感;中度对应明显情感但不过激;重度对应强烈情感表达。该分级用于训练模型在不同情感强度下的语音合成控制; 场景标注:统一标注场景为“御姐”; 说话人属性:标注说话人标识(VRT014)及性别(女)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、情感强度分级。 四、数据应用说明 本数据集可直接用于训练御姐角色语音合成模型、角色情感语音识别系统、虚拟偶像交互引擎等AI任务。数据集中每段语音均包含完整的转写文本及情感强度分级标注,标注规范、结构清晰,可作为御姐人设智能化应用的基准训练数据,尤其适用于需要控制情感强度的有声小说角色配音、虚拟职场助手及游戏NPC语音生成等垂直场景。
浙江省数据知识产权登记平台2026-08-11 更新70
南京话方言语音标注训练数据
南京话方言语音识别
方言口语理解
本数据集聚焦南京话方言的语音识别与自然口语理解。南京话是江淮官话的代表性方言之一,在南京都市圈的本地生活服务、社区沟通、文化传承中有实际需求,现有普通话语音模型难以处理南京话的儿化音、入声及特定声调变异。本数据在专业录音棚采集一位南京本地女性说话人的自发口语叙事,每段语音均附有人工汉字转写,并标注儿化音密度(高/中/低),完整保留南京话特有的语气及词汇。 独立性与必要性 本数据集的特征——真实口语表达、话题自然延续、包含丰富的儿化音及方言修辞——是训练面向南京地区智能语音系统的关键资源。目前公开发音的南京话语料较为稀缺,本数据集填补了这一空白,具有明确的独立存在价值,是推动南京话语音识别、方言保护及本地化人机交互的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的南京话自然口语叙事语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位南京本地女性说话人的自发独白叙事,话题覆盖日常生活、社会观察、情感思考等,无预设脚本干预。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由精通南京话的专业标注人员对每段语音进行精细化人工标注,针对方言数据特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留南京话特有词汇及特有句式,忠实记录语气助词; 儿化音密度分级:根据每段语音中儿化音(如“碗儿”、“碟儿”、“小孩儿”等)出现的总次数除以时长,将儿化音密度分为高、中、低三级,用于训练模型在不同儿化音密度下的方言识别与合成能力; 场景标注:根据内容统一标注场景为“南京话”; 说话人属性:标注说话人性别(女)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、儿化音密度。 四、数据应用说明 本数据集可直接用于训练南京话方言场景下的语音识别模型、口语语义理解模型、方言语音合成系统等AI任务。数据集中每段语音均包含完整的转写文本及儿化音密度标注,标注规范、结构清晰,可作为南京话智能化应用的基准训练数据,尤其适用于南京地区的智能客服、本地化语音助手、社区便民服务以及方言文化数字化保护等垂直场景。
浙江省数据知识产权登记平台2026-08-25 更新10
湖南塑普方言语音标注训练数据
方言语音识别
口音适应
本数据集聚焦湖南塑普(湖南口音普通话)的语音识别与自然口语理解,核心解决现有标准普通话模型难以准确识别塑普中声调偏误、鼻边音不分、平翘舌混淆等特征的问题,通过专业录音棚采集的湖南本地女性说话人自发对话语音及“方言纯度”三级标注,支撑模型在不同方言纯度下的识别与适应能力。除内部训练外,该数据集可广泛复用于湖南地区智能客服与本地生活服务的语音交互、方言区普通话教学辅助、口音识别与方言适应系统开发、本地化语音助手及智能家居设备的口音适配,以及面向湖南市场的语音产品本地化优化等多元场景,为湖南地区普通话智能化应用提供高质量基准数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的湖南塑普自然对话语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位湖南本地女性说话人的自发对话,话题覆盖日常生活、社会热点、个人观点等,无预设脚本干预。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉湖南口音的专业标注人员对每段语音进行精细化人工标注,针对方言数据特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留湖南塑普特有词汇及口音影响下的用词习惯,确保转写文本忠实反映发音与口语表达; 方言纯度分级:根据语音中方言词汇的密集程度、声调特征(如阳平读低升、上声不明显)的明显度,将每段语音的方言纯度分为高、中、低三级。该分级用于训练模型在不同方言纯度下的识别与适应能力; 场景标注:根据内容统一标注场景为“湖南塑普”; 说话人属性:标注说话人性别(女)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、方言纯度。 四、数据应用说明 本数据集可直接用于训练湖南塑普方言口音场景下的语音识别模型、口语语义理解模型、方言口音适应系统等AI任务。数据集中每段语音均包含完整的转写文本及方言纯度标注,标注规范、结构清晰,可作为湖南地区普通话智能化应用的基准训练数据,尤其适用于湖南地区的智能客服、本地化语音助手、方言区普通话教学以及口音识别等垂直场景。
浙江省数据知识产权登记平台2026-08-19 更新20
阳光男生角色语音标注训练数据
AI语音合成
情感语音交互
本数据集聚焦阳光男生角色语音合成与情感交互,服务于有声小说、虚拟伴侣、游戏NPC、青春剧配音、正能量语音助手等场景。阳光男生角色语音特征为语调明快、充满活力、语气乐观向上,常用鼓励、宠溺、调皮式表达。本数据在专业录音棚采集一位男性说话人模拟阳光男生人设的自然对话,涵盖日常关怀、情感鼓励、幽默调侃、生活陪伴等丰富场景,每段语音附人工转写,并标注语调类型(平静/轻快/兴奋),完整保留阳光男生特有的鼓励性语气、幽默调侃及积极向上的情感表达。 独立性与必要性 本数据集的特征——语调明快、活力充沛、乐观鼓励——是训练阳光男生角色语音合成的关键资源。目前面向青春活力型男性人设的高质量语音语料较为稀缺,本数据集填补了这一空白,具有明确的独立存在价值,是推动阳光男生角色语音合成、虚拟男友互动、青春剧配音及正能量语音助手塑造的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的阳光男生角色扮演语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位男性说话人(VRT006)模拟阳光男生人设的自发对话,话题涵盖日常关怀、情感鼓励、生活调侃等,要求说话人保持“语调明快、充满活力”的阳光音色,无预设脚本。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除,保证数据一致性。 二、特征标注 由熟悉角色配音的标注人员对每段语音进行精细化人工标注,针对阳光男生角色特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留阳光男生特有的鼓励式、调皮式词汇及句式,忠实记录语气词及情感表达; 语调类型标注:根据语音的语调起伏、节奏变化和情绪饱满度,将每句语音的语调类型分为平静、轻快、兴奋三类。 该分类用于训练模型在不同情绪状态下的语音合成控制,提升阳光男生角色的生动性; 场景标注:统一标注场景为“阳光男生”; 说话人属性:标注说话人标识(VRT006)及性别(男)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、语调类型。 四、数据应用说明 本数据集可直接用于训练阳光男生角色语音合成模型、角色情感语音识别系统、青春向AI语音助手等AI任务。数据集中每段语音均包含完整的转写文本及语调类型标注,标注规范、结构清晰,可作为阳光男生人设智能化应用的基准训练数据,尤其适用于有声小说角色配音、虚拟男友/伴侣、游戏NPC语音生成及青春活力型语音交互等垂直场景。
浙江省数据知识产权登记平台2026-08-14 更新10
趣味科普语音标注训练数据
趣味科普语音合成
知识讲解语音标注
本数据集聚焦趣味科普风格的语音合成与知识讲解,服务于在线教育、知识科普类App、智能语音助手、儿童启蒙内容等场景。趣味科普语音特征为语调生动、语速适中、富有知识性和趣味性,常以通俗易懂的方式讲解历史、地理、生物、生活常识等话题。本数据在专业录音棚采集一位女性说话人模拟趣味科普风格的语音讲解,内容涵盖佛教历史、地理知识、健康常识、名人轶事、传统文化等广泛话题,每段语音附人工转写,并标注知识领域(人文历史/自然科学/生活常识),完整保留科普讲解的口语化风格及知识性表达。 独立性与必要性 本数据集的特征——语调生动、知识性强、话题广泛——是训练科普类语音合成与知识讲解的关键资源。目前面向趣味科普风格的口语讲解语料较为稀缺,本数据集填补了这一空白,具有独立存在价值,是推动在线教育智能配音、知识科普AI助手、儿童启蒙语音内容等应用的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的趣味科普风格语音讲解,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位女性说话人(SPK005)模拟趣味科普风格的语音讲解,内容涵盖历史、地理、生物、健康、传统文化、生活常识等,每段独立成句或成段,要求保持“语调生动、语速适中”的讲解感。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉科普内容标注的人员对每段语音进行精细化人工标注,针对趣味科普特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留科普讲解的口语化风格及知识性表达; 知识领域标注:根据讲解内容的核心主题,将每段语音的知识领域分为人文历史、自然科学、生活常识三类。该分类用于训练模型在不同知识领域下的讲解风格适配能力; 场景标注:统一标注场景为“趣味科普”; 说话人属性:标注说话人标识(SPK005)及性别(女)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、知识领域。 四、数据应用说明 本数据集可直接用于训练趣味科普风格语音合成模型、知识讲解自动配音系统、智能教育语音助手等AI任务。数据集中每段语音均包含完整的转写文本及知识领域标注,标注规范、结构清晰,可作为科普类语音智能化应用的基准训练数据,尤其适用于在线教育课程配音、科普短视频解说、儿童启蒙语音内容生成等垂直场景。
浙江省数据知识产权登记平台2026-08-14 更新10
儿童绘本语音标注训练数据
儿童语音合成
儿童有声内容生成
本数据集聚焦儿童绘本风格的口语叙事语音合成与理解,服务于儿童有声读物、绘本伴读、亲子教育、儿童语音助手等场景。儿童绘本语音特征为语调亲切、语速适中、富有情感起伏,常用生活化表达和简单句式。本数据在专业录音棚采集一位女性说话人模拟绘本讲述风格的口语叙事,内容为迪士尼乐园游记分享,涵盖美食、购物、游玩体验等丰富话题,每段语音附人工转写,并标注内容主题(游玩体验/美食推荐/购物经历),完整保留口语化叙事语气及生活化表达。 独立性与必要性 本数据集的特征——语调亲切、语速适中、生活化叙事——是训练儿童有声内容语音合成的关键资源。目前面向儿童绘本风格的口语叙事语料较为稀缺,本数据集填补了这一空白,具有独立存在价值,是推动儿童有声读物自动配音、绘本伴读AI、亲子教育语音助手等应用的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的儿童绘本风格口语叙事语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位女性说话人(SPK004)模拟绘本讲述风格的口语叙事,内容为迪士尼乐园游记分享,涵盖游玩体验、美食推荐、购物经历等,无预设脚本,要求保持“语调亲切、语速适中”的讲述感。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉儿童内容标注的人员对每段语音进行精细化人工标注,针对儿童绘本特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留口语化叙事语气及生活化表达; 内容主题标注:根据讲述的核心内容,将每段语音的主题分为游玩体验、美食推荐、购物经历三类。该分类用于训练模型在不同主题下的讲述风格适配能力; 场景标注:统一标注场景为“绘本”; 说话人属性:标注说话人标识(SPK004)及性别(女)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、内容主题。 四、数据应用说明 本数据集可直接用于训练儿童绘本风格语音合成模型、有声内容自动配音系统、童声语音助手等AI任务。数据集中每段语音均包含完整的转写文本及内容主题标注,标注规范、结构清晰,可作为儿童语音智能化应用的基准训练数据,尤其适用于儿童有声读物生成、绘本伴读机器人、亲子教育语音交互等垂直场景。
浙江省数据知识产权登记平台2026-08-11 更新20
关于我们
遇见数据集——让每个数据集都被发现,让每一次遇见都有价值。
数发科官网www.sfktec.com
联系我们
selectdataset@iotsh.com.cn
商业合作
数据驱动未来,携手共赢发展
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15沪公网安备31010402336585号
热门搜索