遇见数据集

SI-Lab/Stepcount-500

收藏
Hugging Face2026-03-25 更新2026-03-29 收录
官方服务:

资源简介:

--- dataset_info: features: - name: images sequence: image - name: problem dtype: string - name: answer dtype: string splits: - name: train num_bytes: 106400000 num_examples: 500 download_size: 106400000 dataset_size: 106400000 configs: - config_name: default data_files: - split: train path: data/train-* --- # Stepcount-500 ## Dataset Description Stepcount-500 is a benchmark dataset of 500 counting samples with object counts ranging from 11 to 50. ## Dataset Structure ### Data Fields - `images`: A sequence of images (one image per sample) - `problem`: The question text describing the counting task - `answer`: The ground truth count number ### Data Splits - **train**: 500 evaluation samples ## Dataset Statistics - Count range: 11-50 - Distribution: 11-20 (130), 21-30 (130), 31-40 (120), 41-50 (120) - Total dataset size: approximately 106 MB ## Usage ```python from datasets import load_dataset ds = load_dataset("SI-Lab/Stepcount-500") ```

--- 数据集信息: 特征: - 名称:images(图像序列) - 名称:problem,数据类型:字符串 - 名称:answer,数据类型:字符串 划分: - 名称:train,字节数:106400000,样本数:500 下载大小:106400000 数据集大小:106400000 配置: - 配置名称:default,数据文件: - 划分:train,路径:data/train-* --- # Stepcount-500 ## 数据集描述 Stepcount-500 是一款包含500个计数样本的基准数据集,其目标计数范围为11至50。 ## 数据集结构 ### 数据字段 - `images`:图像序列(每个样本对应一张图像) - `problem`:用于描述计数任务的问题文本 - `answer`:真实计数标签 ### 数据划分 - **train**:包含500个评估样本 ## 数据集统计信息 - 计数范围:11-50 - 样本分布:11-20(130个)、21-30(130个)、31-40(120个)、41-50(120个) - 数据集总大小:约106 MB ## 使用示例 python from datasets import load_dataset ds = load_dataset("SI-Lab/Stepcount-500")

提供机构:
SI-Lab
二维码
社区交流群
二维码
科研交流群
商业服务