登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
中文多音字语料库
中文多音字语料库
收藏
江苏数据交易所
2026-01-30 收录
自然语言处理
语音合成
数据链接:
https://exchange.jsdataex.com/trade-home/#/project/tradingMarket/productDetail?productId=955
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
582071条中文多音字语料库,适用于虚拟主播,语音助手等各个场景对AI模型的更高精度训练
应用场景:
提供机构:
苏州数据资产运营有限公司
搜集汇总
背景与挑战
背景概述
该数据集是一个专门针对中文多音字问题的大规模语料库,包含超过58万条语料。它适用于虚拟主播、语音助手等多种应用场景,旨在通过高质量数据提升AI模型在语音识别和自然语言处理中的精度和表现。
以上内容由遇见数据集搜集并总结生成
相关数据集
zjunlp/OceanBench
海洋学
自然语言处理
--- license: mit language: - en tags: - Ocean pretty_name: OceanBench size_categories: - 10K<n<100K --- We release OceanBench, which is part of the dataset for evaluating [OceanGPT](https://github.co
Hugging Face
2024-07-05 更新
22
0
kms7530/gemma-korean
自然语言处理
机器学习
--- dataset_info: features: - name: source dtype: string - name: text dtype: string - name: prompt dtype: string splits: - name: train num_bytes: 290333249.0 num_exampl
Hugging Face
2024-04-30 更新
12
0
Large-Scale Preference Dataset
自然语言处理
机器学习
Training Powerful Reward & Critic Models with Aligned Language Models
kaggle
2023-11-26 更新
9
0
Thanmay/xquad-hi
跨语言问答评估
自然语言处理
该数据集包含多个特征,如id、标题、上下文、问题、答案、答案起始位置、类别、聚类、最近聚类和最近页面。这些特征以不同的数据类型存储,包括字符串、整数序列和结构化数据。数据集仅包含一个验证集,大小为36745196字节,包含1190个示例。数据集的下载大小为1189437字节。
Hugging Face
2024-06-28 更新
19
0
Persian News Dataset
波斯语新闻
自然语言处理
Ideal for NLP tasks, sentiment analysis, topic modeling, and more.
kaggle
2023-09-18 更新
10
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广