MedNERF
收藏arXiv2025-09-30 收录
官方服务:
资源简介:
该数据集是一个法语医疗命名实体识别(NER)数据集,它基于一组法语医疗处方的样本构建而成,这些样本遵循与n2c2数据集相同的标注指南。该数据集旨在用于测试目的,并包含了使用n2c2标签进行的标注,这些标签包括药物(DRUG)、剂量强度(STRENGTH)、频率(FREQUENCY)、持续时间(DURATION)、剂量(DOSAGE)和剂型(FORM)。该数据集的规模为100个句子,包含406个标注实体,其任务是命名实体识别。
This dataset is a French medical named entity recognition (NER) dataset constructed from a set of French medical prescription samples, which follow the same annotation guidelines as the n2c2 dataset. It is designed for testing purposes and includes annotations using n2c2 tags, covering Drug (DRUG), Dose Strength (STRENGTH), Frequency (FREQUENCY), Duration (DURATION), Dosage (DOSAGE) and Dosage Form (FORM). The dataset contains 100 sentences and 406 annotated entities, with the task being named entity recognition.
提供机构:
Posos搜集汇总
数据集介绍

背景与挑战
背景概述
MedNERF是一个法语医疗命名实体识别(NER)数据集,专门设计用于评估医疗NER模型的性能。它包含100条法语医疗处方文本,标注了药物、强度、剂型、剂量、持续时间和频率等实体,遵循IOB格式,并基于n2c2标注指南构建。
以上内容由遇见数据集搜集并总结生成



