遇见数据集

中文文本韵律标注语料数据

收藏
杭州数据交易所2026-06-29 更新2026-06-30 收录
官方服务:

资源简介:

用于训练BERT/TinyBERT、LSTM-Attention、CRF、Span-based、HPM、Conformer等。提升韵律边界预测、停顿 / 重音 / 语调精准生成、情感表达、长文本一致性,增强对诗词格律、专业术语、对话交互的稳健性。服务于TTS、智能客服、有声内容、ASR、语言教学、影视配音、心理健康评估等场景。

创建时间:
2025-12-30
搜集汇总
数据集介绍
中文文本韵律标注语料数据 数据集图片
背景与挑战
背景概述
该数据集是中文文本韵律标注语料,包含20万条来自新闻和日常聊天的句子,采用四级韵律标注体系。数据可用于训练BERT、CRF等多种模型,提升韵律边界预测、停顿重音生成等能力,服务于TTS、智能客服、ASR等场景。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务