遇见数据集

kasvnmtp/vlm-image-captioning-dataset

收藏
Hugging Face2025-10-13 更新2025-10-25 收录
官方服务:

资源简介:

这是一个用于图像字幕任务的定制化视觉语言模型(VLM)数据集,包含适用于微调视觉语言模型的图像-文本对。

This is a custom Vision Language Model (VLM) dataset for image captioning tasks, containing image-text pairs suitable for finetuning vision-language models.

提供机构:
kasvnmtp
二维码
社区交流群
二维码
科研交流群
商业服务