遇见数据集

方言数据集

收藏
杭州数据交易所2026-05-08 更新2026-06-18 收录
官方服务:

资源简介:

用于训练方言 ASR、TTS、对话理解、文本处理、双语互译等算法,提升方言场景下的语音识别 / 合成质量、语义理解精度、文本处理规范性、跨语言翻译准确性,以及对不同口音、俚语、低资源方言的鲁棒性,广泛应用于方言智能客服、本地政务语音助手、方言文化保护、跨方言沟通工具等场景。

创建时间:
2025-12-30
搜集汇总
数据集介绍
方言数据集 数据集图片
背景与挑战
背景概述
该方言数据集包含2万小时、存储量2-3TB的语音数据,覆盖国内所有地区方言,主要用于训练方言ASR、TTS、对话理解及双语互译等算法。它旨在提升方言场景下的语音识别/合成质量、语义理解精度及跨语言翻译准确性,增强对不同口音和低资源方言的鲁棒性,可广泛应用于方言智能客服、政务语音助手及方言文化保护等场景。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务