AI-MO/aimo-validation-amc|数学竞赛数据集|数据验证数据集
收藏数据集概述
数据集信息
- 特征:
id
: 整数类型problem
: 字符串类型answer
: 浮点数类型url
: 字符串类型
- 分割:
train
: 包含83个样本,占用32699字节
- 下载大小: 19141字节
- 数据集大小: 32699字节
配置
- 配置名称:
default
- 数据文件:
train
: 路径为data/train-*
- 数据文件:
数据集来源
- 数据集包含83个样本,来源于AMC12 2022和AMC12 2023,提取自AOPS wiki页面。
数据集用途
- 作为AIMO进步奖竞赛中的内部验证集。
- 使用2021年之后的数据以避免与MATH训练集的潜在重叠。
数据集字段说明
problem
: 修改后的问题陈述answer
: 适应的整数答案url
: 问题页面的URL
数据集创建过程
- 原始AMC12问题为多项选择题,包含4个选项。
- 为了更接近AIMO进步奖的条件,问题陈述被修改为要求整数输出。
- 无法修改陈述的问题被拒绝。
示例
原始问题
Flora the frog starts at 0 on the number line and makes a sequence of jumps to the right. In any one jump, independent of previous jumps, Flora leaps a positive integer distance $m$ with probability $frac{1}{2^m}$. What is the probability that Flora will eventually land at 10? $ extbf{(A)}~frac{5}{512}qquad extbf{(B)}~frac{45}{1024}qquad extbf{(C)}~frac{127}{1024}qquad extbf{(D)}~frac{511}{1024}qquad extbf{(E)}~frac{1}{2}$
修改后的问题
Flora the frog starts at 0 on the number line and makes a sequence of jumps to the right. In any one jump, independent of previous jumps, Flora leaps a positive integer distance $m$ with probability $frac{1}{2^m}$. What is the probability that Flora will eventually land at 10? Write the answer as a simplified fraction $frac{m}{n}$, find $m+n$

LinkedIn Salary Insights Dataset
LinkedIn Salary Insights Dataset 提供了全球范围内的薪资数据,包括不同职位、行业、地理位置和经验水平的薪资信息。该数据集旨在帮助用户了解薪资趋势和市场行情,支持职业规划和薪资谈判。
www.linkedin.com 收录
LFW
人脸数据集;LFW数据集共有13233张人脸图像,每张图像均给出对应的人名,共有5749人,且绝大部分人仅有一张图片。每张图片的尺寸为250X250,绝大部分为彩色图像,但也存在少许黑白人脸图片。 URL: http://vis-www.cs.umass.edu/lfw/index.html#download
AI_Studio 收录
A00_13081a.jpg
Link to OCHRE database: http://pi.lib.uchicago.edu/1001/org/ochre/a8598ac4-9093-d548-30f3-84ce2ec953a7
DataONE 收录
Plant-Diseases
Dataset for Plant Diseases containg variours Plant Disease
kaggle 收录
AgiBot World
为了进一步推动通用具身智能领域研究进展,让高质量机器人数据触手可及,作为上海模塑申城语料普惠计划中的一份子,智元机器人携手上海人工智能实验室、国家地方共建人形机器人创新中心以及上海库帕思,重磅发布全球首个基于全域真实场景、全能硬件平台、全程质量把控的百万真机数据集开源项目 AgiBot World。这一里程碑式的开源项目,旨在构建国际领先的开源技术底座,标志着具身智能领域 「ImageNet 时刻」已到来。AgiBot World 是全球首个基于全域真实场景、全能硬件平台、全程质量把控的大规模机器人数据集。相比于 Google 开源的 Open X-Embodiment 数据集,AgiBot World 的长程数据规模高出 10 倍,场景范围覆盖面扩大 100 倍,数据质量从实验室级上升到工业级标准。AgiBot World 数据集收录了八十余种日常生活中的多样化技能,从抓取、放置、推、拉等基础操作,到搅拌、折叠、熨烫等精细长程、双臂协同复杂交互,几乎涵盖了日常生活所需的绝大多数动作需求。
github 收录