JingweiNi/train_prm800k_gpt-oss-120b_annotated_qwen3_1.7b_thinking_5000_shards_4_7_4_random
收藏数据链接:
官方服务:
资源简介:
该数据集包含多个特征,如question(问题)、answer(答案)、input_ids(输入标识符)、reply(回复)、original_index(原始索引)、claims(声明)和verified(已验证)。claims特征进一步细分为aligned_token_ids(对齐的令牌标识符)、claim_text(声明文本)和sentence(句子)。数据集仅包含一个名为train的分割,共有2,500个示例,总大小为34,683,522字节。
The dataset includes features such as question, answer, input_ids, reply, original_index, claims, and verified. The claims feature is further detailed into aligned_token_ids, claim_text, and sentence. The dataset has a single split called train with 2,500 examples and a total size of 34,683,522 bytes.
提供机构:
JingweiNi


