open-r1/details-open-r1_OpenR1-Distill-7B
收藏资源简介:
--- dataset_info: - config_name: main.aime24.2025-05-22T09-33-40 features: - name: choices sequence: 'null' - name: cont_tokens sequence: sequence: sequence: int64 - name: example dtype: string - name: full_prompt dtype: string - name: gold sequence: string - name: gold_index sequence: 'null' - name: input_tokens sequence: sequence: int64 - name: instruction dtype: string - name: metrics struct: - name: math_pass@1:16_samples dtype: float64 - name: math_pass@1:1_samples dtype: float64 - name: math_pass@1:32_samples dtype: float64 - name: math_pass@1:4_samples dtype: float64 - name: math_pass@1:64_samples dtype: float64 - name: math_pass@1:8_samples dtype: float64 - name: num_asked_few_shots dtype: int64 - name: num_effective_few_shots dtype: int64 - name: padded sequence: int64 - name: pred_logits sequence: 'null' - name: prediction_logits sequence: 'null' - name: predictions sequence: string - name: specifics dtype: 'null' - name: truncated sequence: int64 splits: - name: train num_bytes: 270904603 num_examples: 30 download_size: 56827673 dataset_size: 270904603 - config_name: main.aime25.2025-05-22T09-43-43 features: - name: choices sequence: 'null' - name: cont_tokens sequence: sequence: sequence: int64 - name: example dtype: string - name: full_prompt dtype: string - name: gold sequence: string - name: gold_index sequence: 'null' - name: input_tokens sequence: sequence: int64 - name: instruction dtype: string - name: metrics struct: - name: math_pass@1:16_samples dtype: float64 - name: math_pass@1:1_samples dtype: float64 - name: math_pass@1:32_samples dtype: float64 - name: math_pass@1:4_samples dtype: float64 - name: math_pass@1:64_samples dtype: float64 - name: math_pass@1:8_samples dtype: float64 - name: num_asked_few_shots dtype: int64 - name: num_effective_few_shots dtype: int64 - name: padded sequence: int64 - name: pred_logits sequence: 'null' - name: prediction_logits sequence: 'null' - name: predictions sequence: string - name: specifics dtype: 'null' - name: truncated sequence: int64 splits: - name: train num_bytes: 294700486 num_examples: 30 download_size: 62407123 dataset_size: 294700486 - config_name: main.gpqa.2025-05-22T08-42-54 features: - name: choices sequence: 'null' - name: cont_tokens sequence: sequence: sequence: int64 - name: example dtype: string - name: full_prompt dtype: string - name: gold sequence: string - name: gold_index sequence: 'null' - name: input_tokens sequence: sequence: int64 - name: instruction dtype: string - name: metrics struct: - name: gpqa_pass@1:1_samples dtype: float64 - name: gpqa_pass@1:4_samples dtype: float64 - name: gpqa_pass@1:8_samples dtype: float64 - name: num_asked_few_shots dtype: int64 - name: num_effective_few_shots dtype: int64 - name: padded sequence: int64 - name: pred_logits sequence: 'null' - name: prediction_logits sequence: 'null' - name: predictions sequence: string - name: specifics struct: - name: extracted_golds sequence: string - name: extracted_predictions sequence: string - name: truncated sequence: int64 splits: - name: train num_bytes: 146797891 num_examples: 198 download_size: 32707008 dataset_size: 146797891 - config_name: main.lcb_v4.2025-05-22T10-29-24 features: - name: choices sequence: 'null' - name: cont_tokens sequence: sequence: sequence: int64 - name: example dtype: string - name: full_prompt dtype: string - name: gold sequence: string - name: gold_index sequence: 'null' - name: input_tokens sequence: sequence: int64 - name: instruction dtype: string - name: metrics struct: - name: codegen_pass@1:16 dtype: float64 - name: num_asked_few_shots dtype: int64 - name: num_effective_few_shots dtype: int64 - name: padded sequence: int64 - name: pred_logits sequence: 'null' - name: prediction_logits sequence: 'null' - name: predictions sequence: string - name: specifics struct: - name: fn_name dtype: string - name: inputs sequence: string - name: outputs sequence: string - name: truncated sequence: int64 splits: - name: train num_bytes: 2666506716 num_examples: 101 download_size: 1643460052 dataset_size: 2666506716 - config_name: main.math_500.2025-05-22T08-30-50 features: - name: choices sequence: 'null' - name: cont_tokens sequence: sequence: sequence: int64 - name: example dtype: string - name: full_prompt dtype: string - name: gold sequence: string - name: gold_index sequence: 'null' - name: input_tokens sequence: sequence: int64 - name: instruction dtype: string - name: metrics struct: - name: math_pass@1:1_samples dtype: float64 - name: math_pass@1:4_samples dtype: float64 - name: num_asked_few_shots dtype: int64 - name: num_effective_few_shots dtype: int64 - name: padded sequence: int64 - name: pred_logits sequence: 'null' - name: prediction_logits sequence: 'null' - name: predictions sequence: string - name: specifics dtype: 'null' - name: truncated sequence: int64 splits: - name: train num_bytes: 87447379 num_examples: 500 download_size: 17791293 dataset_size: 87447379 configs: - config_name: main.aime24.2025-05-22T09-33-40 data_files: - split: train path: main.aime24.2025-05-22T09-33-40/train-* - config_name: main.aime25.2025-05-22T09-43-43 data_files: - split: train path: main.aime25.2025-05-22T09-43-43/train-* - config_name: main.gpqa.2025-05-22T08-42-54 data_files: - split: train path: main.gpqa.2025-05-22T08-42-54/train-* - config_name: main.lcb_v4.2025-05-22T10-29-24 data_files: - split: train path: main.lcb_v4.2025-05-22T10-29-24/train-* - config_name: main.math_500.2025-05-22T08-30-50 data_files: - split: train path: main.math_500.2025-05-22T08-30-50/train-* ---
数据集信息: - 配置名称:main.aime24.2025-05-22T09-33-40 特征项: - 名称:choices,类型:序列,取值为null - 名称:cont_tokens,类型:三级int64整数Token(Token)序列 - 名称:example,数据类型:字符串 - 名称:full_prompt,数据类型:字符串 - 名称:gold,类型:字符串序列 - 名称:gold_index,类型:序列,取值为null - 名称:input_tokens,类型:二级int64整数Token(Token)序列 - 名称:instruction,数据类型:字符串 - 名称:metrics,结构体类型,包含以下字段: - 字段名:math_pass@1:1_samples,含义为数学单样本通过率(math_pass@1:1_samples),数据类型:float64 - 字段名:math_pass@1:8_samples,含义为数学8样本单样本通过率(math_pass@1:8_samples),数据类型:float64 - 字段名:math_pass@1:16_samples,含义为数学16样本单样本通过率(math_pass@1:16_samples),数据类型:float64 - 字段名:math_pass@1:32_samples,含义为数学32样本单样本通过率(math_pass@1:32_samples),数据类型:float64 - 字段名:math_pass@1:4_samples,含义为数学4样本单样本通过率(math_pass@1:4_samples),数据类型:float64 - 字段名:math_pass@1:64_samples,含义为数学64样本单样本通过率(math_pass@1:64_samples),数据类型:float64 - 名称:num_asked_few_shots,数据类型:int64 - 名称:num_effective_few_shots,数据类型:int64 - 名称:padded,类型:整数序列 - 名称:pred_logits,类型:预测对数概率序列(pred_logits),取值为null - 名称:prediction_logits,类型:预测对数概率序列(prediction_logits),取值为null - 名称:predictions,类型:字符串序列 - 名称:specifics,数据类型:null - 名称:truncated,类型:整数序列 数据集划分: - 划分名称:train,字节数:270904603,样本数:30 下载大小:56827673,数据集总大小:270904603 - 配置名称:main.aime25.2025-05-22T09-43-43 特征项: - 名称:choices,类型:序列,取值为null - 名称:cont_tokens,类型:三级int64整数Token(Token)序列 - 名称:example,数据类型:字符串 - 名称:full_prompt,数据类型:字符串 - 名称:gold,类型:字符串序列 - 名称:gold_index,类型:序列,取值为null - 名称:input_tokens,类型:二级int64整数Token(Token)序列 - 名称:instruction,数据类型:字符串 - 名称:metrics,结构体类型,包含以下字段: - math_pass@1:1_samples,数学单样本通过率(math_pass@1:1_samples),float64 - math_pass@1:8_samples,数学8样本单样本通过率(math_pass@1:8_samples),float64 - math_pass@1:16_samples,数学16样本单样本通过率(math_pass@1:16_samples),float64 - math_pass@1:32_samples,数学32样本单样本通过率(math_pass@1:32_samples),float64 - math_pass@1:4_samples,数学4样本单样本通过率(math_pass@1:4_samples),float64 - math_pass@1:64_samples,数学64样本单样本通过率(math_pass@1:64_samples),float64 - 名称:num_asked_few_shots,数据类型:int64 - 名称:num_effective_few_shots,数据类型:int64 - 名称:padded,类型:整数序列 - 名称:pred_logits,类型:预测对数概率序列(pred_logits),取值为null - 名称:prediction_logits,类型:预测对数概率序列(prediction_logits),取值为null - 名称:predictions,类型:字符串序列 - 名称:specifics,数据类型:null - 名称:truncated,类型:整数序列 数据集划分: - 划分名称:train,字节数:294700486,样本数:30 下载大小:62407123,数据集总大小:294700486 - 配置名称:main.gpqa.2025-05-22T08-42-54 特征项: - 名称:choices,类型:序列,取值为null - 名称:cont_tokens,类型:三级int64整数Token(Token)序列 - 名称:example,数据类型:字符串 - 名称:full_prompt,数据类型:字符串 - 名称:gold,类型:字符串序列 - 名称:gold_index,类型:序列,取值为null - 名称:input_tokens,类型:二级int64整数Token(Token)序列 - 名称:instruction,数据类型:字符串 - 名称:metrics,结构体类型,包含以下字段: - gpqa_pass@1:1_samples,GPQA单样本通过率(gpqa_pass@1:1_samples),float64 - gpqa_pass@1:4_samples,GPQA4样本单样本通过率(gpqa_pass@1:4_samples),float64 - gpqa_pass@1:8_samples,GPQA8样本单样本通过率(gpqa_pass@1:8_samples),float64 - 名称:num_asked_few_shots,数据类型:int64 - 名称:num_effective_few_shots,数据类型:int64 - 名称:padded,类型:整数序列 - 名称:pred_logits,类型:预测对数概率序列(pred_logits),取值为null - 名称:prediction_logits,类型:预测对数概率序列(prediction_logits),取值为null - 名称:predictions,类型:字符串序列 - 名称:specifics,结构体类型,包含以下字段: - extracted_golds,类型:字符串序列 - extracted_predictions,类型:字符串序列 - 名称:truncated,类型:整数序列 数据集划分: - 划分名称:train,字节数:146797891,样本数:198 下载大小:32707008,数据集总大小:146797891 - 配置名称:main.lcb_v4.2025-05-22T10-29-24 特征项: - 名称:choices,类型:序列,取值为null - 名称:cont_tokens,类型:三级int64整数Token(Token)序列 - 名称:example,数据类型:字符串 - 名称:full_prompt,数据类型:字符串 - 名称:gold,类型:字符串序列 - 名称:gold_index,类型:序列,取值为null - 名称:input_tokens,类型:二级int64整数Token(Token)序列 - 名称:instruction,数据类型:字符串 - 名称:metrics,结构体类型,包含以下字段: - codegen_pass@1:16,代码生成单样本通过率(codegen_pass@1:16),float64 - 名称:num_asked_few_shots,数据类型:int64 - 名称:num_effective_few_shots,数据类型:int64 - 名称:padded,类型:整数序列 - 名称:pred_logits,类型:预测对数概率序列(pred_logits),取值为null - 名称:prediction_logits,类型:预测对数概率序列(prediction_logits),取值为null - 名称:predictions,类型:字符串序列 - 名称:specifics,结构体类型,包含以下字段: - fn_name,数据类型:字符串 - inputs,类型:字符串序列 - outputs,类型:字符串序列 - 名称:truncated,类型:整数序列 数据集划分: - 划分名称:train,字节数:2666506716,样本数:101 下载大小:1643460052,数据集总大小:2666506716 - 配置名称:main.math_500.2025-05-22T08-30-50 特征项: - 名称:choices,类型:序列,取值为null - 名称:cont_tokens,类型:三级int64整数Token(Token)序列 - 名称:example,数据类型:字符串 - 名称:full_prompt,数据类型:字符串 - 名称:gold,类型:字符串序列 - 名称:gold_index,类型:序列,取值为null - 名称:input_tokens,类型:二级int64整数Token(Token)序列 - 名称:instruction,数据类型:字符串 - 名称:metrics,结构体类型,包含以下字段: - math_pass@1:1_samples,数学单样本通过率(math_pass@1:1_samples),float64 - math_pass@1:4_samples,数学4样本单样本通过率(math_pass@1:4_samples),float64 - 名称:num_asked_few_shots,数据类型:int64 - 名称:num_effective_few_shots,数据类型:int64 - 名称:padded,类型:整数序列 - 名称:pred_logits,类型:预测对数概率序列(pred_logits),取值为null - 名称:prediction_logits,类型:预测对数概率序列(prediction_logits),取值为null - 名称:predictions,类型:字符串序列 - 名称:specifics,数据类型:null - 名称:truncated,类型:整数序列 数据集划分: - 划分名称:train,字节数:87447379,样本数:500 下载大小:17791293,数据集总大小:87447379 配置项数据文件详情: - 配置名称:main.aime24.2025-05-22T09-33-40,数据文件: - 划分:train,路径:main.aime24.2025-05-22T09-33-40/train-* - 配置名称:main.aime25.2025-05-22T09-43-43,数据文件: - 划分:train,路径:main.aime25.2025-05-22T09-43-43/train-* - 配置名称:main.gpqa.2025-05-22T08-42-54,数据文件: - 划分:train,路径:main.gpqa.2025-05-22T08-42-54/train-* - 配置名称:main.lcb_v4.2025-05-22T10-29-24,数据文件: - 划分:train,路径:main.lcb_v4.2025-05-22T10-29-24/train-* - 配置名称:main.math_500.2025-05-22T08-30-50,数据文件: - 划分:train,路径:main.math_500.2025-05-22T08-30-50/train-*



