zlaabsi/opentq-qwen36-bf16-sidecar
收藏资源简介:
该数据集发布用于比较OpenTQ GGUF artifacts与基础模型Qwen/Qwen3.6-27B在固定实用小子集上的BF16 sidecar输出。数据集包含三种配置:results(每个基准测试样本一行,包含提示、任务ID、确定性BF16输出、得分字段和计时)、benchmarks(每次运行的基准测试摘要一行,包含通过计数和通过率)和runs(每个sidecar作业/模式一行,包含模型、运行时、提示格式和聚合元数据)。这些数据是小型发布质量信号,不替代完整基准测试,仅用于BF16与GGUF的配对回归检查。官方完整测试的Qwen分数仍然是模型能力声明的基础。
This dataset publishes BF16 sidecar outputs used to compare OpenTQ GGUF artifacts against the base model `Qwen/Qwen3.6-27B` on pinned practical mini-subsets. It contains three configurations: results (one row per benchmark sample with prompts, task IDs, deterministic BF16 outputs, score fields, and timing), benchmarks (one row per benchmark per run with summary pass counts and pass rates), and runs (one row per sidecar job/mode with model, runtime, prompt format and aggregate metadata). These are small release-quality signals, not full benchmark replacements, intended for paired BF16-vs-GGUF regression checks only. Official full-harness Qwen scores remain the baseline for model capability claims.




