遇见数据集

玄幻有声小说语音标注训练数据

收藏
浙江省数据知识产权登记平台2026-08-08 更新2026-08-09 收录
官方服务:

资源简介:

本数据集聚焦有声小说风格的语音合成与长文本朗读,服务于听书平台、有声内容生产、AI配音、广播剧制作等场景。有声小说语音特征为语调自然、节奏适中、富有情感张力,需根据情节切换语气(紧张、舒缓、激昂等)。本数据在专业录音棚采集一位男性说话人朗读玄幻小说的语音,内容为完整章节的叙事与对话,涵盖打斗、对话、场景描写等多种文本类型,每段语音附人工转写,并标注文本类型(叙述/对话/描写),完整保留朗读的断句、语气及情感表达。 独立性与必要性 本数据集的特征——长篇连贯叙事、多情感语气切换、角色对话区分——是训练有声小说语音合成的关键资源。目前面向长文本朗读的高质量语音语料较为稀缺,本数据集填补了这一空白,具有独立存在价值,是推动听书平台自动配音、有声内容AI生成、广播剧角色朗读等应用的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的有声小说朗读语音,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位男性说话人(SPK006)朗读玄幻小说的章节内容,涵盖叙事、对话、战斗描写等,要求保持“语调自然、节奏稳定”的朗读感,并根据情节适当切换语气。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉有声内容标注的人员对每段语音进行精细化人工标注,针对有声小说特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留朗读的断句、语气及情感表达; 文本类型标注:根据朗读内容的性质,将每段语音的文本类型分为叙述、对话、描写三类。 该分类用于训练模型在不同文本类型下的朗读风格切换能力; 场景标注:统一标注场景为“有声小说”; 说话人属性:标注说话人标识(SPK006)及性别(男)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、文本类型。 四、数据应用说明 本数据集可直接用于训练有声小说风格语音合成模型、长文本朗读自动配音系统、情感语音播报等AI任务。数据集中每段语音均包含完整的转写文本及文本类型标注,标注规范、结构清晰,可作为有声内容智能化应用的基准训练数据,尤其适用于听书平台有声内容生成、广播剧配音、AI故事讲述等垂直场景。

创建时间:
2026-06-23
搜集汇总
数据集介绍
玄幻有声小说语音标注训练数据 数据集图片
背景与挑战
背景概述
该数据集包含一位男性朗读者在专业录音棚录制的玄幻小说有声内容,共159.8MB,提供48kHz采样率的WAV音频,并配有逐字转写文本及叙述、对话、描写等文本类型标注。数据旨在支持有声小说风格的语音合成与长文本朗读,适用于听书平台、AI配音及广播剧制作等应用,是训练长文本连贯叙事、情感语气切换及角色对话区分的关键资源。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务