{ "backbone": "ProCreations/grug-27b-v2-candidate-20260912-qwen", "backbone_frozen": true, "backbone_revision": "eb3994615a9c74115c11be960d761f2ab30b5690", "baseline": { "gold_top1": 0.8370026257321753, "loss": 0.3502399525067444, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.904396418232007 }, "dataset": "ProCreations/grug-27b-v2-build-20260912", "dataset_revision": "e12e39b899f962c2f87ef461808f68d510e4fb4a", "draft_hidden_input": "backbone last_hidden_state AFTER final RMSNorm; matches vLLM 0.29.0 and pinned llama.cpp h_nextn", "evaluation_split": "task-group-disjoint validation", "final": { "gold_top1": 0.8382818285868174, "loss": 0.2964827782645103, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.9089746179223053 }, "gradient_accumulation": 4, "learning_rate": 5e-05, "max_length": 2048, "mtp_source": "Qwen/Qwen3.8-27B", "mtp_source_revision": "1d4bf0f2ff6012fd82039f2fa52739d0dd7c60c0", "mtp_tensors_loaded": 15, "optimizer_steps": 634, "selected_optimizer_step": 500, "selected_tokens": 1862103, "selection": "Maximum held-out teacher agreement among checkpoints with no increase in validation loss", "source_code_revision": "e4ef8a305f6da88207fb1c08eab5f3a347b456a5", "supervised_tokens": 801095, "teacher": "ProCreations/grug-27b-v2-candidate-20260912-qwen greedy next-token decisions", "trainable_parameters": 424699392, "trained_rows": 2536, "training_hours": 0.4222, "validation_history": [ { "gold_top1": 0.8324917525079109, "loss": 0.36836922397504135, "step": 100, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.8948360600552077 }, { "gold_top1": 0.8328957113041137, "loss": 0.33981012553954, "step": 200, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.8982697098229314 }, { "gold_top1": 0.8368006463340739, "loss": 0.3142550937201325, "step": 300, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.9043290917659732 }, { "gold_top1": 0.8380125227226823, "loss": 0.30122779384394877, "step": 400, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.9073587827374942 }, { "gold_top1": 0.8382818285868174, "loss": 0.2964827782645103, "step": 500, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.9089746179223053 }, { "gold_top1": 0.8381471756547498, "loss": 0.29589416033576355, "step": 600, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.9087726385242039 }, { "gold_top1": 0.8382145021207836, "loss": 0.29576130904814096, "step": 634, "supervised_tokens": 14853.0, "teacher_top1_agreement": 0.9088399649902377 } ], "validation_rows": 48 }