HuggingFaceM4/FineVisionMax
收藏官方服务:
资源简介:
FineVision是一个包含17.3M张图片、24.3M个样本、88.9M个对话回合和9.5B个答案标记的大型数据集,设计用于训练最先进的开放视觉语言模型。数据集结构包括图片、对话文本、来源和多种评分信息。
FineVision is a massive collection of datasets with 17.3M images, 24.3M samples, 88.9M turns, and 9.5B answer tokens, designed for training state-of-the-art open Vision-Language-Models. The dataset structure includes images, dialogue texts, source information, and various rating metrics.
提供机构:
HuggingFaceM4


