DeepPavlov/XRISAWOZ_es
收藏资源简介:
该数据集是一个多领域对话数据集,包含用户和系统之间的对话记录。每个对话有唯一的对话ID和轮次ID,涵盖多个领域(如医院、餐厅、电脑、景点等)。特征包括对话文本、历史记录、用户动作和系统动作,以及大量以inform-和request-为前缀的字段,这些字段表示特定领域的信息提供或请求,例如inform-Hospital-metro station(医院-地铁站信息)和request-film length(请求电影时长)。数据集分为训练集(659个示例)、验证集(4058个示例)和测试集(4643个示例),适用于自然语言处理任务,如对话状态跟踪或意图识别。
This dataset is a multi-domain dialogue dataset containing records of conversations between users and systems. Each conversation has a unique dialogue ID and turn ID, covering multiple domains (e.g., hospital, restaurant, computer, attraction). Features include dialogue text, history, user actions, and system actions, along with numerous fields prefixed with inform- and request-, which indicate information provision or requests in specific domains, such as inform-Hospital-metro station and request-film length. The dataset is divided into training set (659 examples), validation set (4058 examples), and test set (4643 examples), suitable for natural language processing tasks like dialogue state tracking or intent recognition.




