medical-triage-triples
收藏资源简介:
Medical Triage RL Triples 是一个来自 Medical Triage OpenEnv 环境 (v2.3.0) 的强化学习数据集,包含 '(observation, action, reward)' 三元组。数据集涵盖11种临床任务和75个患者案例,每个案例包含完整的临床描述文本、任务指令提示、智能体响应JSON、标量奖励值以及详细的评分分解。奖励计算基于NHS NEWS2、PEWS (Duncan 2006)、SOFA (Vincent 1996)、SSC Hour-1 Bundle 2021和NHS SBAR 2018等标准。数据集字段包括任务ID、案例ID、患者病史、任务描述、智能体动作、奖励值、评分分解和模型类型。适用于医疗分诊相关的强化学习研究和应用。
Medical Triage RL Triples is a reinforcement learning dataset sourced from the Medical Triage OpenEnv environment (v2.3.0), which comprises '(observation, action, reward)' triples. The dataset encompasses 11 clinical tasks and 75 patient cases, with each case containing complete clinical description text, task instruction prompts, agent response JSON files, scalar reward values, and detailed scoring breakdowns. The reward computation adheres to established clinical standards including NHS NEWS2, PEWS (Duncan 2006), SOFA (Vincent 1996), SSC Hour-1 Bundle 2021, and NHS SBAR 2018. The dataset includes the following fields: task ID, case ID, patient medical history, task description, agent action, reward value, scoring breakdown, and model type. This dataset is tailored for reinforcement learning research and applications focused on medical triage.
Medical Triage RL Triples 数据集概述
数据集简介
该数据集包含来自 Medical Triage OpenEnv 环境(版本 v2.3.0)的 (observation, action, reward) 三元组。
数据字段
| 字段 | 描述 |
|---|---|
task_id |
11项临床任务之一 |
case_id |
唯一的患者病例标识符 |
patient_history |
完整的临床表现文本 |
task_description |
智能体指令提示 |
action |
智能体响应的 JSON 数据 |
reward |
标量奖励,范围在 (0.0001, 0.9999) |
score_breakdown |
各维度得分明细 |
model |
使用的模型或智能体类型 |
任务与规模
- 任务数量:11项临床任务。
- 病例数量:75个病例。
- 任务列表:simple_triage, conflicting_vitals, masked_deterioration, demographic_fairness, deteriorating_patient, sepsis_bundle, paediatric_triage, medication_reconciliation, icu_deterioration, sbar_handover, differential_diagnosis。
评分机制
奖励由确定性的部分学分评分器计算,其依据包括 NHS NEWS2、PEWS (Duncan 2006)、SOFA (Vincent 1996)、SSC Hour-1 Bundle 2021 和 NHS SBAR 2018。
数据来源
数据通过 scripts/export_hf_dataset.py 脚本从 kunalkachru23/medical-triage-env v2.3.0 生成。




