遇见数据集

MIMIC-IV-Ext-MedicalBench: Evaluating Large Language Models Towards Improved Medical Concept Extraction

收藏
PhysioNet2026-06-27 收录
官方服务:

资源简介:

This dataset is an evidence‑grounded benchmark built on MIMIC‑IV discharge summaries that evaluates how well large language models can verify ICD‑10 medical concepts, including implicitly documented diagnoses, by identifying supporting text evidence.

二维码
社区交流群
二维码
科研交流群
商业服务