MedSynVQA-13K
收藏资源简介:
MedSynVQA是一个用于医学视觉问答(VQA)任务的完整训练集,支持RLVR训练。它还包括多个子集,分别为10K、5K、2K和1K样本的训练子集,以及针对不同实验设置的额外子集,如生成器和验证器选择的消融研究、PMC-VQA风格提示生成的子集和为SFT训练生成的子集。
MedSynVQA is a comprehensive training dataset for medical visual question answering (VQA) tasks, which supports RLVR training. It also includes multiple subsets: training subsets with 10K, 5K, 2K and 1K samples respectively, as well as additional subsets for different experimental settings, such as ablation study subsets selected by the generator and validator, subsets for PMC-VQA-style prompt generation, and subsets generated for SFT training.
MedSynVQA-13K 数据集概述
基本信息
- 许可证: Apache 2.0
- 模态: 图像-文本
- 用途: 医学视觉语言问答,支持RLVR/SFT训练
数据集描述
- 完整名称: MedSynVQA
- 生成器: GLM-4.5V 108B
- 验证器: Qwen2.5-VL 72B
- 描述: 用于医学视觉问答的完整训练集(用于RLVR)
相关资源
- 代码仓库: https://github.com/UCSC-VLAA/MedVLSynther
- 项目页面: https://ucsc-vlaa.github.io/MedVLSynther/
- 下载地址: https://huggingface.co/datasets/MedVLSynther/MedVLSynther-13K
数据格式
python { "images": [PIL.Image], # 图像列表 "question": str, # 问题文本 "options": Dict[str, str], # 多项选择选项 "answer_label": str, # 正确答案标签(A、B、C、D、E) "answer": str, # 完整答案文本 "reasoning": str, # 思维链推理(可选) "dataset_name": str, # 源数据集名称 "dataset_index": int # 唯一样本标识符 }
使用方式
python from datasets import load_dataset
加载训练数据集
train_dataset = load_dataset("MedVLSynther/MedSynVQA-13K")




