登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
医疗病历文本数据标注
医疗病历文本数据标注
收藏
杭州数据交易所
2026-08-04 更新
2026-06-18 收录
文本结构化
临床信息抽取
数据链接:
https://mall.hzdex.cn/data-exchange/110600100191069?from=/data-exchange
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
通过对电子病历的标注使电子病历数据更加结构化和规范化
应用场景:
提供机构:
国盛君安(杭州)医疗科技有限公司
创建时间:
2026-08-04
搜集汇总
数据集介绍
背景与挑战
背景概述
该数据集专注于医疗病历文本的标注处理,旨在通过标注使电子病历数据更加结构化和规范化,提升数据的可用性和分析价值。
以上内容由遇见数据集搜集并总结生成
相关数据集
vbv373/eval_metrics_5000_generations_test_text2struc_text_code_1116
文本结构化
代码评估
该数据集包含多个字段,如化合物名称、材料项目ID、转换信息、描述、真实值等,字段类型包括字符串和浮点数。数据集分为错误部分,共有5000个示例,数据大小为18812553字节。
Hugging Face
2025-02-12 更新
9
0
医疗数据脱敏
医疗数据隐私
数据脱敏技术
提供医疗数据脱敏,匿名化或者去标识化服务
杭州数据交易所
2026-08-04 更新
5
0
Dataset 2 - Representação LexML dos Textos Articulados das Normas Legislativas Federais
文本结构化
法律信息处理
Contém os textos articulados de cada norma do dataset anterior estruturados em formato LexML.
Figshare
2018-02-26 更新
3
0
European Clinical Case Corpus
临床信息抽取
多语言NLP
E3C is a freely available multilingual corpus (English, French, Italian, Spanish, and Basque) of semantically annotated clinical narratives to allow for the linguistic analysis, benchmarking, and trai
DataCite Commons
2022-06-01 更新
6
0
protocol-sections-normalized
协议文档解析
文本结构化
该数据集包含结构化协议文档内容,主要字段包括协议ID(protocol_id)、章节编号(section_number)、标题(title)、正文内容(content)以及合并标题列表(merged_titles)。所有字段均为字符串类型,其中merged_titles为字符串列表。数据集仅包含训练集(train),包含18,103个样本,总大小约47.5MB。未提供数据集的具体背景、收集目的或适
Hugging Face
2026-01-26 更新
4
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广