laolengsaeu/shan-phonology-master-database
收藏资源简介:
该数据集是世界上首个系统、全面的掸语(လိၵ်ႈတႆး / Tai Shan)声学音系映射,专为生成式人工智能、文本转语音(TTS)和人工智能歌唱语音合成(SVS)引擎设计。它旨在解决掸语等少数民族语言在数字领域资源不足的问题,通过基于标准六声调对比系统,从本土语言角度全面映射掸语书写系统中的每个有效语音单元。数据集结构遵循掸语音节矩阵的标准化工程层次,包含五个计算阶段的干净、高保真语音单元:1) 核心元音系统(10个基础元音矩阵在六声调上的映射);2) 双元音系统(包括ဢႆ、ဢဝ်、ဢႂ်结构在六声调上的映射);3) 辅音簇(使用介音ယ、ရ和ဝ在所有声调级别上的耦合);4) 鼻韵尾(以-မ်、-ၼ်和-င်结尾的闭音节,映射音高长度变化);5) 塞音韵尾(以-ပ်、-တ်和-ၵ结尾的闭音节,映射突然音高中断)。音频属性包括工作室级高保真、干燥人声配置,适合深度学习模型,且所有录音单元均通过数字音高校准手动验证,防止音调漂移或语音模糊。
许可协议: CC BY-NC 4.0 语言: - shn 多语言属性: - 单语言 数据规模类别: - 样本数少于1000 任务类别: - 文本转语音(Text-to-Speech) - 音频分类 标签: - 掸语(shan-language) - 语音学(phonology) - 声学数据库(acoustic-database) - 缅甸语言(myanmar-languages) - AI歌声合成(ai-singing) 展示名称: 掸语声学语音学主数据库 # 掸语声学语音学主数据库 ## 项目概述 本数据集为全球首个针对原生掸语(လိၵ်ႈတႆး / 泰掸语)语音学进行的系统性、全面性声学映射数据集,专为生成式AI(Generative AI)、文本转语音(Text-to-Speech, TTS)及人工智能歌声合成(Singing Voice Synthesis, SVS)引擎打造。 历史上,壮侗语族下的小众及区域语言在数字领域长期面临资源严重匮乏的困境。本项目通过从本土语言学视角出发,针对标准化**六声调对立系统**下掸语书写体系中的每一个有效语音单元进行隔离式采集,以此填补数字鸿沟。 ### 创作者与知识产权 * **首席研究员与母语使用者:** 赛劳伦赛(Sai Lao Leng Saeu,ကိုစိုင်းလောဝ်) * **数据集架构:** 与AI系统集成团队联合开发(2026年5月) * **状态:** 100%验证通过的基础核心已锁定 ## 数据集结构与规格 本数据集严格遵循掸语音节矩阵的标准化结构工程与构建层级。为避免连续会话语音带来的协同发音模糊问题,本数据库收录的均为清晰隔离的高保真语音单元(Token),并分为5个独立计算阶段: 1. **第一阶段:မႄႈၵပ်းငဝ်ႈ(核心元音系统)** —— 针对六声调下的10个基础元音矩阵进行映射。 2. **第二阶段:မႄႈၵပ်းသွၼ်ႉ(双元音系统)** —— 针对包括ဢႆ、ဢဝ်、ဢႂ在内的次生元音系统,在全六声调范围内完成映射。 3. **第三阶段:မႄႈသဵင်သွၼ်ႉ(中间辅音丛)** —— 针对使用介音**ယ(ႁွပ်ႈ)**、**ရ(လဵပ်ႈ)**及**ဝ(ၵႂၢႆႉ)**的辅音滑音组合,在所有声调层级下完成映射。 4. **第四阶段:တူဝ်ၽႅတ်းသႅင်လင(鼻音韵尾/持续音)** —— 以持续鼻音声道收尾的闭音节:包括**-မ်(双唇鼻音)**、**-ၼ်(齿龈鼻音)**及**-င်(软腭鼻音)**韵尾,并针对音高长度变化完成映射。 5. **第五阶段:တူဝ်ၽႅတ်းသဵင်ၶၢတ်ႇ(塞音韵尾/突发断音)** —— 以不送气突发塞音收尾的闭音节:包括**-ပ်(双唇塞音)**、**-တ်(齿龈塞音)**及**-ၵ်(软腭塞音)**韵尾,并针对尖锐音高断裂完成映射。 ### 音频属性 * **声学保真度:** 采用工作室级纯净干声配置,专为深度学习模型优化。 * **声调验证:** 所有录制的语音单元均通过数字音高追踪进行人工复核,以避免音调漂移或发音含糊。 ## 许可协议与使用条款 本仓库严格受**知识共享署名-非商业性使用4.0国际许可协议(Creative Commons Attribution-NonCommercial 4.0 International License, CC BY-NC 4.0)**保护。 ### 允许行为 * **分享与改编:** 您可对本数据集进行复制、再分发、提取,并基于其开展学术研究、个人项目或开源语言学软件开发。 ### 必须遵守的条款 * **署名(BY):** 您**必须**对创作者(**赛劳伦赛**)给予适当署名,提供本Hugging Face仓库的链接,并注明是否对数据集进行了修改。 * **非商业使用(NC):** 未经作者书面许可,您**不得**将本数据集或基于本数据集直接训练的模型(如文本转语音引擎、RVC语音克隆模型或歌声合成工具)用于商业获利或变现。 如需学术引用,请按以下格式标注本仓库: > Sai Lao Leng Saeu (2026). Shan Language Acoustic Phonology Master Database for Generative AI Systems. Hugging Face Dataset Repository. > 赛劳伦赛(2026). 《面向生成式AI系统的掸语声学语音学主数据库》. Hugging Face数据集仓库。




