趣味科普语音标注训练数据
收藏资源简介:
本数据集聚焦趣味科普风格的语音合成与知识讲解,服务于在线教育、知识科普类App、智能语音助手、儿童启蒙内容等场景。趣味科普语音特征为语调生动、语速适中、富有知识性和趣味性,常以通俗易懂的方式讲解历史、地理、生物、生活常识等话题。本数据在专业录音棚采集一位女性说话人模拟趣味科普风格的语音讲解,内容涵盖佛教历史、地理知识、健康常识、名人轶事、传统文化等广泛话题,每段语音附人工转写,并标注知识领域(人文历史/自然科学/生活常识),完整保留科普讲解的口语化风格及知识性表达。 独立性与必要性 本数据集的特征——语调生动、知识性强、话题广泛——是训练科普类语音合成与知识讲解的关键资源。目前面向趣味科普风格的口语讲解语料较为稀缺,本数据集填补了这一空白,具有独立存在价值,是推动在线教育智能配音、知识科普AI助手、儿童启蒙语音内容等应用的必要基础数据。一、数据采集与预处理 原始数据来源于杭州万像循声科技有限公司在专业录音棚内录制的趣味科普风格语音讲解,均为WAV格式,采样率48kHz。录音环境为强吸声、高信噪比的专业声学环境,确保音频质量。采集内容为一位女性说话人(SPK005)模拟趣味科普风格的语音讲解,内容涵盖历史、地理、生物、健康、传统文化、生活常识等,每段独立成句或成段,要求保持“语调生动、语速适中”的讲解感。预处理阶段,使用音频处理工具批量读取每段语音的时长(秒),统一文件命名格式,并对音频进行音量归一化、静音段切除等标准化处理,保证数据一致性。 二、特征标注 由熟悉科普内容标注的人员对每段语音进行精细化人工标注,针对趣味科普特点增加差异化标注项: 语音转写:将音频内容逐字转写为标准汉字,完整保留科普讲解的口语化风格及知识性表达; 知识领域标注:根据讲解内容的核心主题,将每段语音的知识领域分为人文历史、自然科学、生活常识三类。该分类用于训练模型在不同知识领域下的讲解风格适配能力; 场景标注:统一标注场景为“趣味科普”; 说话人属性:标注说话人标识(SPK005)及性别(女)。 三、数据结构化与打包 将上述技术参数(时长、采样率)与人工标注结果汇总为结构化表格文件,每行对应一段语音,字段包括:语音文件名、时长(秒)、采样率(kHz)、场景、说话人/音色、性别、类型、来源与授权、文本、知识领域。 四、数据应用说明 本数据集可直接用于训练趣味科普风格语音合成模型、知识讲解自动配音系统、智能教育语音助手等AI任务。数据集中每段语音均包含完整的转写文本及知识领域标注,标注规范、结构清晰,可作为科普类语音智能化应用的基准训练数据,尤其适用于在线教育课程配音、科普短视频解说、儿童启蒙语音内容生成等垂直场景。




