training: gamma: 1.0 inject_layer: 23 injection_scale: 39.191835884530846 lr: 5.0e-05 method: prior_deviation_reweight resume_from: step_006000 steps: 9000 uniform: false wd: 0.3