遇见数据集

round2-oss-matched

收藏
Hugging Face2026-08-04 更新2026-08-05 收录
官方服务:

资源简介:

该数据集是第二轮匹配实验(round2-oss-matched)产生的 4 组实验数据,每组包含 10 个节点,共 40 个节点。数据集包含以下 JSONL 格式文件:pool.jsonl(样本池)、seeds.jsonl(种子)、budgets.jsonl(预算)、samples.jsonl(采样结果)以及实验 3 中的 cfg_loops.yaml 配置。实验类型包括:实验 0(20B/120B 修复重跑)、实验 1(20B token 对齐独立采样)、实验 2(120B token 对齐独立采样)、实验 3(120B 自测试反馈 SE)。数据适用于大语言模型(20B 和 120B 规模)的采样、对齐和反馈优化任务。

This dataset includes 4 groups of experimental data from the round2-oss-matched (second-round matching) experiment, with 10 nodes per group and a total of 40 nodes. The dataset contains the following JSONL-formatted files: pool.jsonl (sample pool), seeds.jsonl (seed dataset), budgets.jsonl (budget settings), samples.jsonl (sampling results), as well as the cfg_loops.yaml configuration file used in Experiment 3. The experiment types are as follows: Experiment 0 (rerun of 20B/120B models with bug fixes), Experiment 1 (independent sampling for 20B token alignment), Experiment 2 (independent sampling for 120B token alignment), and Experiment 3 (120B self-test feedback SE). This dataset is suitable for sampling, alignment, and feedback optimization tasks for large language models (LLMs) with parameter scales of 20B and 120B.

创建时间:
2026-07-31
原始信息汇总

数据集概述

该数据集为“round2-oss-matched”,是第二轮4组实验数据,包含10个节点,共40个节点数据。主要内容如下:

数据结构

数据集包含以下目录结构:

  • exp0_20b/node00..04/pool.jsonl:实验0的20B模型数据,为shard-05修复重跑
  • exp0_120b/node00..04/pool.jsonl:实验0的120B模型数据,同上
  • exp1_20b/node00..09/{seeds,budgets,pool}.jsonl:实验1的20B token对齐独立采样数据
  • exp2_120b/node00..09/{seeds,budgets,pool}.jsonl:实验2的120B模型数据,同上
  • exp3_120b/node00..09/{ck_nonsat/,nonsat_seeds,budgets,pool,cfg_loops.yaml}:实验3的自测试反馈SE数据
  • loop_budget_v2_adaptive.json:已锁定的逐题loop预算

实验配置

  • 实验1和实验2采用token对齐独立采样方法
  • 实验3采用自测试反馈机制
  • 20B模型通过handoff/serve_20b.sh启动,120B模型使用TP2×4脚本,端口为8000

运行与回传

  • 每个节点有对应的运行命令,需修改RUN_DIR和K参数
  • 支持断点续跑,原样重跑同一条命令即可
  • 实验0/3需回传整个RUN_DIR,实验1/2仅需回传run/samples.jsonl文件及运行日志
二维码
社区交流群
二维码
科研交流群
商业服务