遇见数据集

MIMIC-IV-Ext-MedicalBench: Evaluating Large Language Models Towards Improved Medical Concept Extraction

收藏
官方服务:

资源简介:

This dataset is an evidence‑grounded benchmark built on MIMIC‑IV discharge summaries that evaluates how well large language models can verify ICD‑10 medical concepts, including implicitly documented diagnoses, by identifying supporting text evidence.

提供机构:
PhysioNet
二维码
社区交流群
二维码
科研交流群
商业服务