登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Brat format of the SNPPhenA corpus
Brat format of the SNPPhenA corpus
收藏
Figshare
2017-02-23 更新
2026-04-29 收录
基因-表型关联挖掘
医学文本处理
数据链接:
https://figshare.com/articles/dataset/Brat_format_of_the_SNPPhenA_corpus/4685689
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
XML format of the SNPPhenA corpus
应用场景:
创建时间:
2017-02-23
相关数据集
MCSCSet
医学文本处理
中文拼写纠错
displayName: MCSCSet labelTypes: - Chinese Corpus license: - CC BY-NC 2.0 mediaTypes: - Text paperUrl: https://arxiv.org//pdf/2210.11720.pdf publishDate: "2022" publishUrl: https://github.com/yzhihao/
魔搭社区
2026-03-23 更新
51
0
Natural Hallucination Dataset - ACI-bench Clinical Note Hallucination Annotations
医学文本处理
幻觉检测
该存储库包含来自ACI-bench数据集的专家标注的幻觉标签,用于评估医学文本摘要中的幻觉检测。自然幻觉(NH)数据集包含临床摘要中幻觉的专家标注,重点关注ACI-bench临床对话集中的SOAP笔记。
github
2025-05-24 更新
21
0
prli/pubmed-full_chopped_pyt_llama_alpha_0-1
医学文本处理
自然语言处理
该数据集包含文本、元信息、句子扰动数量以及文档统计信息。文本是数据集的主要特征,元信息中包含了数据集的集合名称。文档统计信息详细记录了文档的优势分数、长度变化比例、原始句子长度、替换后的句子长度等多个统计数据。数据集分为验证集,验证集大小为4000个样本。
Hugging Face
2025-10-14 更新
13
0
xusenlin/cmeee
医学命名实体识别
医学文本处理
CMeEE是一个中文医学命名实体识别数据集,包含文本和实体信息。实体信息包括实体的ID、实体字符串、起始位置、结束位置和标签。数据集分为训练集、测试集和验证集,分别包含15000、3000和5000个样本。
Hugging Face
2022-12-07 更新
40
0
NCBI-disease corpus
医学文本处理
自然语言处理
Leveraging Insights from the Biomedical Natural Language Processing Community
kaggle
2025-07-22 更新
15
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广