普通话自然对话数据集
收藏官方服务:
资源简介:
用于训练基于 Transformer 的对话生成、多轮上下文、问答、意图 / 情感、对话策略等模型,重点提升回复自然度、上下文连贯性、意图情感识别、泛化鲁棒、任务完成效率等能力,广泛应用于智能客服、聊天机器人、智能助手、对话式 AI 等场景。
提供机构:
数据堂(北京)科技股份有限公司创建时间:
2025-12-30
搜集汇总
数据集介绍

背景与挑战
背景概述
该数据集包含约3000小时的普通话自然对话录音,数据量约300-400GB,录音人围绕多个熟悉的话题进行自由对话以保持流畅自然。数据集标注了文本内容、普通话释义、有效句子的起止时间点及说话人标识,主要用于训练基于Transformer的对话生成、多轮上下文、问答、意图情感识别等模型,提升回复自然度和上下文连贯性,适用于智能客服、聊天机器人等对话式AI场景。
以上内容由遇见数据集搜集并总结生成



