登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
智能NLP对话调用数据
智能NLP对话调用数据
收藏
国家基础学科公共科学数据中心
2026-07-10 收录
多语言语音处理
智能语音交互
数据链接:
https://nbsdc.cn/general/dataDetail?id=6a4bd112f175601bcdce3bed&type=1
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
支持 3 种语言的自然语言,识别功能能够支持文字、语音输入的智能对话。同时,输入语音支持中、日、英 3种,输出语音也支持多种音色。代码数据量14.4kb
应用场景:
提供机构:
杭州看潮信息咨询有限公司
相关数据集
MLC-SLM
多语言语音处理
语音识别
MLC-SLM数据集是一个包含约1604小时多语言对话语音数据的真实世界数据集,包含11种语言,包括英语、法语、德语、意大利语、葡萄牙语、西班牙语、日语、韩语、俄语、泰语和越南语。数据集分为训练集、开发集、评估集1和评估集2,每个集合包含大约1507小时、32小时、32小时和32小时的语音数据。数据集旨在用于构建多语言对话语音语言模型,解决语言多样性、说话者变化和上下文挑战。数据集的创建过程包括录
arXiv
2025-09-17 更新
90
0
Dataset Suara Aksen Bahasa Indonesia (5 Suku)
方言语音识别
多语言语音处理
Dataset suara Bahasa Indonesia aksen suku Batak, Melayu, Sunda, Jawa, Papua
kaggle
2024-08-23 更新
23
0
tr-hi-parallel-speech-v2
多语言语音处理
语音合成
该数据集是一个用于多语言语音处理任务的结构化数据集,包含53,506个训练样本。每个样本由音频文件及其对应的文本标注组成,核心特征包括:音频ID、配对ID、源语言代码、目标语言代码、源语言文本、目标语言文本、英文文本、音频数据、语音合成模型名称、语音合成音色、音频时长(秒)、词错误率、字错误率以及数据来源标识。数据集中文、目标文和英文文本的并存表明其支持跨语言任务;音频与TTS相关字段暗示其可能用
Hugging Face
2026-05-26 更新
18
0
ASR-BigSCCompreSC: A Scripted Chinese Comprehensive-use Speech Corpus
语音识别
多语言语音处理
This dataset consists of 477 hours of transcribed Mandarin Chinese scripted speech focusing on keyword spotting, command and query, digits, and news contributed by 1,586 speakers.
MagicHub开源社区
2021-09-15 更新
26
0
YGGYY/GTSinger
歌唱合成
多语言语音处理
--- license: cc-by-nc-sa-4.0 task_categories: - text-to-audio - text-to-speech language: - zh - en - fr - ja - ko - es - de - ru - it tags: - singing - audio - croissant pretty_name: a size_categories
Hugging Face
2026-02-11 更新
20
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广