遇见数据集

shaomin9487/CourtSI-1M

收藏
Hugging Face2026-04-22 更新2026-04-26 收录
官方服务:

资源简介:

CourtSI是一个大规模数据集,旨在研究视觉语言模型(VLMs)在体育环境中的空间智能。它为视觉语言模型的监督微调(SFT)提供了大规模的训练数据。该数据集包含超过100万个问答对,基于一个全面的空间分类法,包括空间计数、距离测量、定位和关系推理。

CourtSI is a large-scale dataset designed to study spatial intelligence in sports environments for Vision-Language Models (VLMs). It provides large-scale training data for supervised fine-tuning (SFT) of vision-language models. The dataset contains over 1M QA pairs, built upon a holistic spatial taxonomy that includes spatial counting, distance measurement, localization, and relational reasoning.

提供机构:
shaomin9487
二维码
社区交流群
二维码
科研交流群
商业服务