数据链接:
官方服务:
资源简介:
PubMedQA Dataset processed by LMFlow team.
应用场景:
创建时间:
2023-03-27
相关数据集
BiomixQA
BiomixQA是一个经过精心策划的生物医学问答数据集,包含两个不同的组成部分:多项选择题(MCQ)和真/假题。该数据集已被用于验证基于知识图谱的检索增强生成(KG-RAG)框架在不同大型语言模型(LLMs)中的表现。数据集中问题的多样性,涵盖多项选择和真/假格式,以及其对各种生物医学概念的覆盖,使其特别适合评估KG-RAG框架的性能。因此,该数据集旨在支持生物医学自然语言处理、知识图谱推理和问答
github2024-09-05 更新840
PubMedQA-MetaGenBlendedRAG
PubMedQA-MetaGen是一个元数据增强的生物医学问答数据集,基于原始PubMedQA数据集,通过MetaGenBlendedRAG管道进行增强。数据集包含了原始和增强的语料库版本,支持传统和元数据驱动的生物医学自然语言处理研究。
Hugging Face2025-05-22 更新170
hirundo-io/mmlu-bio-shuffled
--- dataset_info: features: - name: question dtype: string - name: answer dtype: string - name: subset dtype: string splits: - name: train num_bytes: 413212 num_example
Hugging Face2025-12-24 更新80
bigbio/bioasq_task_b
BioASQ语料库包含由生物医学专家标注的多种问答任务,包括是/否、事实型、列表和摘要问题。特别关注的是是/否问题(Task 7b),每个问题都配有一个包含PubMed摘要中多个句子的参考文本和一个是/否答案。数据集使用了官方的训练/开发/测试分割,分别为670/75/140个问题。
Hugging Face2024-07-24 更新170
GENTEL-Lab/TRQA
TRQA是一个评估数据集,用于评估在治疗目标发现领域的生物医学知识和目标识别技能。它包括两个子数据集:TRQA-lit和TRQA-db。TRQA-lit专注于治疗目标相关的研究发现,构建了一个从文献语料库中总结知名治疗目标最新研究进展的问题回答(QA)数据集。TRQA-db则设计用于系统评估现有方法在解决竞争环境调查问题时信息检索、整合和推理的有效性。
Hugging Face2025-06-03 更新120



