遇见数据集

医疗对话基准数据集DxBench

收藏
官方服务:

资源简介:

DxBench医疗对话基准数据集主要面向真实场景自动诊断评估研究、医疗智能问诊系统开发需求建设,基于MedDialog数据集3121例真实医患对话经GPT-4自动提取与人工复核产生。该数据集源于科技创新2030-"新一代人工智能"重大项目"因果推理与决策理论模型研究"(2021ZD0111600)的指标2.2测试需求,旨在为开放域医疗对话诊断提供高质量、可复现的评测基准,解决现有医疗AI系统缺乏真实场景验证的关键问题。数据集经GPT-4自动抽取病例信息后人工复核,保留1148例高质量案例,覆盖15个临床科室、461种疾病、5038种症状。每例样本包含患者主诉(explicit symptoms)、医生追问所得症状(implicit symptoms)及最终确诊疾病(ground-truth disease)三元组,并给出3个候选疾病用于开放域评测。

提供机构:
中山大学
搜集汇总
数据集介绍
医疗对话基准数据集DxBench 数据集图片
背景与挑战
背景概述
DxBench是一个面向真实场景自动诊断评估与医疗智能问诊系统开发的高质量基准数据集,基于MedDialog中3121例医患对话经GPT-4自动提取与人工复核构建而成。最终保留1148例案例,覆盖15个临床科室、461种疾病及5038种症状,每例样本包含患者主诉、医生追问所得症状及最终确诊疾病三元组,并提供3个候选疾病用于开放域评测。
以上内容由遇见数据集搜集并总结生成
二维码
社区交流群
二维码
科研交流群
商业服务