kasvnmtp/vlm-image-captioning-dataset
收藏官方服务:
资源简介:
这是一个用于图像字幕任务的定制化视觉语言模型(VLM)数据集,包含适用于微调视觉语言模型的图像-文本对。
This is a custom Vision Language Model (VLM) dataset for image captioning tasks, containing image-text pairs suitable for finetuning vision-language models.
提供机构:
kasvnmtp


