方言数据集
收藏官方服务:
资源简介:
用于训练方言 ASR、TTS、对话理解、文本处理、双语互译等算法,提升方言场景下的语音识别 / 合成质量、语义理解精度、文本处理规范性、跨语言翻译准确性,以及对不同口音、俚语、低资源方言的鲁棒性,广泛应用于方言智能客服、本地政务语音助手、方言文化保护、跨方言沟通工具等场景。
提供机构:
数据堂(北京)科技股份有限公司创建时间:
2025-12-30
搜集汇总
数据集介绍

背景与挑战
背景概述
该方言数据集包含2万小时、存储量2-3TB的语音数据,覆盖国内所有地区方言,主要用于训练方言ASR、TTS、对话理解及双语互译等算法。它旨在提升方言场景下的语音识别/合成质量、语义理解精度及跨语言翻译准确性,增强对不同口音和低资源方言的鲁棒性,可广泛应用于方言智能客服、政务语音助手及方言文化保护等场景。
以上内容由遇见数据集搜集并总结生成



