遇见数据集

普通话自然对话数据集

收藏
杭州数据交易所2026-02-09 更新2026-06-18 收录
官方服务:

资源简介:

用于训练基于 Transformer 的对话生成、多轮上下文、问答、意图 / 情感、对话策略等模型,重点提升回复自然度、上下文连贯性、意图情感识别、泛化鲁棒、任务完成效率等能力,广泛应用于智能客服、聊天机器人、智能助手、对话式 AI 等场景。

创建时间:
2025-12-30
搜集汇总
数据集介绍
普通话自然对话数据集 数据集图片
背景与挑战
背景概述
该数据集包含约3000小时的普通话自然对话录音,数据量约300-400GB,录音人围绕多个熟悉的话题进行自由对话以保持流畅自然。数据集标注了文本内容、普通话释义、有效句子的起止时间点及说话人标识,主要用于训练基于Transformer的对话生成、多轮上下文、问答、意图情感识别等模型,提升回复自然度和上下文连贯性,适用于智能客服、聊天机器人等对话式AI场景。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务