aldsouza/healthcare_multiturn_v5
收藏资源简介:
该数据集包含了对话信息,每个对话由多个消息组成,消息包含内容(content)和角色(role)。此外,每个对话还有唯一的标识符(conversation_id),消息的顺序(turn),是否需要澄清(requires_clarification),缺失的字段(missing_fields),是否有澄清问题(clarification_question)和是否是AI提出的问题(is_ai_question)。数据集分为训练集,包含64007个示例,文件大小为245642310字节。
The dataset consists of conversation information, with each conversation made up of multiple messages that include content and role. Additionally, each conversation has a unique identifier (conversation_id), message order (turn), whether clarification is needed (requires_clarification), missing fields (missing_fields), whether there is a clarification question (clarification_question), and whether the question is raised by AI (is_ai_question). The dataset is split into a training set, containing 64,007 examples, with a file size of 245,642,310 bytes.



