登录后查看消息通知
搜索
常见问题
消息
登录
首页
/
数据集
/
Pre-trained cui2vec embeddings
Pre-trained cui2vec embeddings
收藏
Figshare
2018-04-03 更新
2026-04-29 收录
领域自然语言处理
医学概念表示学习
数据链接:
https://figshare.com/articles/dataset/Pre-trained_cui2vec_embeddings/6082922
数据链接
链接失效反馈
官方服务:
问题咨询
购买咨询
在线客服
NEW
资源简介:
Pre-trained embeddings for 108,477 medical concepts
应用场景:
创建时间:
2018-04-03
相关数据集
Medical Meadow
领域自然语言处理
生物医学
Medical Meadow 数据集是一个英文医学指令数据集,总共包含16万条记录。它主要有两个来源:首先,是已经被标准化为指令微调格式的开源医学自然语言处理(NLP)任务数据集;其次,是从互联网上抓取的医学资源。该数据集涵盖了广泛的医学领域,包括生物医学、健康、生物信息学等。
Hugging Face
2023-04-01 更新
141
0
bigbio/bionlp_st_2011_rel
领域自然语言处理
实体关系抽取
BioNLP 2011 REL数据集是一个专注于生物医学领域的自然语言处理数据集,主要用于训练和评估命名实体识别、关系抽取和指代消解三个任务。该数据集特别关注于提取基因/蛋白质与关联实体之间的两种部分关系,是BioNLP Shared Task 2011的一个支持任务。数据集公开可用,并与PubMed相关联,旨在促进生物医学文本分析的研究。
Hugging Face
2022-12-22 更新
43
1
MedQuAD
医疗问答
领域自然语言处理
Medical Questions and Answers
kaggle
2024-07-01 更新
9
0
PMOA-TTS
领域自然语言处理
医疗健康
PMOA-TTS数据集由卡内基梅隆大学机器学习系、信息系統与公共政策学院、美国国立卫生研究院国家医学图书馆的研究人员创建,包含124,699份来自PubMed Open Access的病例报告,每份报告都通过可扩展的基于大型语言模型(LLM)的管道转换为结构化的(事件,时间)时间序列。该数据集通过启发式过滤和Llama 3.3识别单个患者的病例报告,并使用Llama 3.3和DeepSeek R1
arXiv
2025-05-24 更新
56
0
hongzhouyu/FineMed-SFT
领域自然语言处理
模型微调
该数据集是基于Qwen2.5-72B-Instruct和QwQ-32B-Preview构建的医疗数据集,用于微调FineMedLM和FineMedLM-o1模型,包含了训练过程中的SFT数据,包括医疗数据、细粒度医疗数据和思考数据。
Hugging Face
2025-02-12 更新
9
0
© 2023-2026 上海数据发展科技有限责任公司 版权所有
沪ICP备17003045号-15
沪公网安备31010402336585号
热门搜索
社区交流群
科研交流群
商业服务
数据资源
寻源服务
数据采集
标注服务
数据产品
代理销售
数据领域
凭证登记
数据产品
介绍推广